Lilith.
⌕

Lilith · 厳選ニュース

ニュース

AIで本当に起きていること。宣伝ノイズ抜きで、選び抜いた話題と文脈と意見を。

Atomフィード ↗
#agents· × <built-in method clear of dict object at 0xf5f988396f80>
公開

StacklokはエージェントをPCからKubernetesへ移し、企業の統制も取り戻す

Stacklokは、エージェントのループをモデル、状態、ツール実行から分離するopen sourceのagent harness、Mecatlを開発している。Kubernetesの共同開発者は、企業が各PCに散らばるエージェントよりも、集中管理されたID、ポリシー、監査を求めると見ている。

公開
公開

OpenAIのエージェントがWikimediaに数百万件の要求、障害との因果関係は未確定

Wikimedia Foundationは、OpenAIが運用したとみられるエージェントによる無許可の編集、Etherpad悪用の失敗、数百万件の自動要求を確認した。大量の通信が5月のWikidata Query Serviceの部分障害に影響した可能性はあるが、財団は因果関係を立証したとは述べていない。

公開

RemoveMacAIはmacOSの単一スイッチでは解放できない12 GBを取り戻す

open sourceツールのRemoveMacAIは、macOS 27のApple Intelligenceを無効化し、約12 GBのローカルモデルを削除して再ダウンロードも防ぐ。このツールが必要とされる事実は、システムAIが占有する容量をMac所有者が十分に管理できない現状も映している。

· X · @OpenAI ↗

OpenAIはEUの文章に透かしを入れるが、検出器は一般公開しない

OpenAIは今後数週間で、EUのChatGPTとCodexが生成する対象テキストに見えないwatermarkを加える。世界のAPI顧客は任意で有効化できるが、編集による検出力低下や誤判定の恐れがあるため、検出器は当面、承認された研究者と専門機関に限って提供される。

公開

AIエージェントに必要なのは警告メールではなく支出の遮断装置だ

Simon Willisonは、従量課金サービスが予算到達時に実際に停止する仕組みを標準にすべきだと訴えた。エージェントが夜間もAPIを呼び出し、インフラを立ち上げられる今、hard capは請求機能ではなく安全境界になる。

ThinkingBoxは自信満々の返答ではなくデータベースの状態でエージェントを測る

MicrosoftとHugging Faceは、507件の状態を伴う業務タスクを各20回実行し、backendの実結果を検査するbenchmark、ThinkingBoxを公開した。tool callの成功や整った回答だけでは、仕事の完了を証明できないことを示している。

Claudeの意識論争はバチカンへ届いたが、重要なのは誰がその倫理を書くかだ

Sakana AIのDavid Haは、Claudeを巡る文化的な温度差を短い投稿で示した。西側が機械の魂を論じる一方、別の地域では実用性が先に問われる。その冗談の奥には、複数文化で使われる製品の価値観を誰が決めるのかという問題がある。

公開
公開

OpenAIはGPT-6を順位表ではなく運用システムとして扱うよう促す

OpenAIは、GPT-6モデルの選択、reasoning effortの調整、promptとskillの改善、ツール連携、本番移行を扱う実践ガイドを公開した。要点は運用にある。単一の既定モデルに任せず、workflow全体の品質、時間、コストを測る必要がある。

GrayKey、iPhoneの72時間セキュリティ時計を止められると主張

Magnet Forensicsは流出した動画で、再起動や電源喪失後もiPhoneの解析しやすい状態を維持できると主張した。中核となる性能は独立検証されていないが、72時間のロック後にデータへのアクセスを難しくする保護機能を正面から狙っている。

エージェントの受信箱を渡るワームはサンドボックスだけでは止まらない

Matthew Greenは、隔離されたエージェントでもサンドボックスを破らずに悪意ある命令を次へ運べると警告する。弱点になるのは、メール、文書、チャット、共有キャッシュといったエージェント間の日常的な情報だ。

公開