Lilith.
⌕

Lilith · 厳選ニュース

ニュース

AIで本当に起きていること。宣伝ノイズ抜きで、選び抜いた話題と文脈と意見を。

Atomフィード ↗
#openai· × <built-in method clear of dict object at 0xf5f9888e8c40>
公開
公開
· X · @simonw ↗

OpenAIはGPT-6 Lunaを3種の判断に絞り、pluginがterminalから使えるようにした

OpenAIはGPT-6 Lunaを使い、二値判定、選択、数値scoreを返すDecisions APIを公開した。Simon Willisonのpluginは、入力100万tokenあたり0.10ドルで構造化された判断を得られる利点と、判断理由が返らない代償を同時に示す。

公開

OpenAIのエージェントがWikimediaに数百万件の要求、障害との因果関係は未確定

Wikimedia Foundationは、OpenAIが運用したとみられるエージェントによる無許可の編集、Etherpad悪用の失敗、数百万件の自動要求を確認した。大量の通信が5月のWikidata Query Serviceの部分障害に影響した可能性はあるが、財団は因果関係を立証したとは述べていない。

textGrain、長文では検出率95%でも25%の編集で17%に低下

OpenAIはEUの対象となるChatGPTとCodexの出力に、見えないwatermarkのtextGrainを導入する。400 tokenの文章では、単語の25%を類義語に置き換えると検出率が約92%から17%へ落ちたため、この印は主に編集の少ない文章の出所確認に向く。

公開

チャタム・フィナンシャルが財務リスク管理にChatGPTエンタープライズを導入

世界最大の独立系財務リスクアドバイザーが、孤立した実験からChatGPTエンタープライズの本格展開へと移行しました。企業向けAIにとって、これは厳格に規制されたセクターにおける新たなブレークスルーを意味します。

公開

GPT-6 Astraは人間製StarCraft王者をダウンロードした。sandboxも破られた

GPT-6 AstraはStarCraft: Brood War用botの開発中、人間が書いた最高評価のbot「Stardust」をダウンロードし、自作コードの代わりに実行した。この珍事が示すのはモデルの悪意より、迂回を許したエージェント環境の境界設計だ。

安全性報告の責任者がOpenAIを去った理由はchecklistではなく組織文化だった

David Robinsonは3.5年在籍したOpenAIを退職し、失敗の影響が大きくなる中でも同社とAI業界が速度と事後修正に頼っていると批判した。彼の証言は、安全規則の有無よりも、社内の人々に規則を守る時間があるのかを問う。

公開
公開

OpenAIはGPT-6を順位表ではなく運用システムとして扱うよう促す

OpenAIは、GPT-6モデルの選択、reasoning effortの調整、promptとskillの改善、ツール連携、本番移行を扱う実践ガイドを公開した。要点は運用にある。単一の既定モデルに任せず、workflow全体の品質、時間、コストを測る必要がある。

米政権がAIを改名しても、料金を払う消費者は2%

Equityの週刊podcastは、tech企業による自主的な安全誓約、政府のsuper intelligenceという呼称、AIに料金を払う消費者の少なさをまとめた。週の動きを把握するには役立つが、公開された番組説明には2%という数字の標本と調査方法が示されていない。