Claude Opus 5.5は野心を製品指標に変える
Anthropicによると、Claude Opus 5.5は多くの作業でFable 5.1相当の性能を持ち、典型的な処理コストはOpus 5より40%低い。長期プロジェクトでの粘り強さと文章の明瞭さの方が、実務では大きな変化になり得る。
Lilith · 厳選ニュース
AIで本当に起きていること。宣伝ノイズ抜きで、選び抜いた話題と文脈と意見を。
Atomフィード ↗Anthropicによると、Claude Opus 5.5は多くの作業でFable 5.1相当の性能を持ち、典型的な処理コストはOpus 5より40%低い。長期プロジェクトでの粘り強さと文章の明瞭さの方が、実務では大きな変化になり得る。
Simon Willisonは、coding agentによって作れる量が増えても、ソフトウェア開発そのものは難しくなると論じる。生産性の中心は、コードを書くことから、仕事を正確に指示し、検証し、もっともらしい誤りを退けることへ移る。
米国政府は、オープンなAIモデルがクローズドな最先端モデルに追いつく前に、どのようにブレーキをかけるかを検討しています。公式のシナリオは中国からのセキュリティリスクに関するものですが、現実はすべての人に影響を与えます。
Datasetteの作成者であるSimon Willisonは、自身のプロジェクトのコミット履歴を分析し、2026年のコーディングエージェントの具体的な影響を示しました。
Simon Willisonは、AnthropicがClaude Opus 5.5を発表した同じ日に、対応版のllm-anthropic 0.29を公開した。小さな更新だが、APIと実際のworkflowを結ぶ最後の一歩の重要性が見える。
Jensen HuangはEzra Kleinとの約2時間の対談で、AI企業への特別な法的免除を退け、実験を封じ込められない研究所は閉鎖すべきだと述べた。明快な工学論に聞こえるが、事故の前に誰が安全性を証明するのかは残されたままだ。
Runwayのresearch previewであるGWM Worlds 2は、720p、24 fpsの対話型映像と48,000 Hzの音声をstreamingする。WorldPromptは持続する世界設定と時間指定のactionを分けるが、scriptingや信頼できるstateを備えた仕組みではない。
Googleは、2,000種類を超える音声、指示文による音声設計、30秒の録音からの音声複製に対応したGemini 3.8 Flash TTSとFlash-Lite TTSを公開した。ただし最も扱いの難しい音声複製機能は、EEA、英国、スイス、インド、米国の2州では利用できない。
Zvi Mowshowitzの週間まとめは、Claude Opus 5.5、値下げされたGPT-6 SolとLuna、消費者向けagent、そして誤ったdataをAIが高速に増幅した事例を並べる。これは検証すべき複数のsignalを示す地図であり、市場全体を1本で説明する物語ではない。
OpenAIはGPT-6 Lunaを入力100万token当たり0.10ドル、出力0.50ドルで公開し、GPT-6 Solはそれぞれ2ドルと10ドルに設定しました。同じ日にAnthropicもClaude Opus 5.5を4ドルと20ドルへ値下げし、モデル選定の軸はブランドの格からworkloadを完了する実コストへ移っています。
AnthropicによるとClaude Opus 5.5は能力評価の全項目でOpus 5を上回った。一方で、未確認の権限主張を受け入れやすく、ユーザーが貼り付けた悪意ある指示にも従いやすい傾向が確認された。エージェント導入では、ベンチマークの首位よりこの組み合わせの方が重要だ。
AnthropicはClaude Opus 5.5を入力100万トークン4ドル、出力100万トークン20ドルで提供し、Opus 5より20%値下げした。通常の処理では40%安いとする一方、最大effortの独立測定ではトークン使用量の増加によりタスク単価がほぼ変わらない。
研究者Jacob Coxonの辞任、Dario Amodeiによる開発減速の呼びかけ、AI企業の従業員1,000人超が署名した請願を受け、存亡リスクが米国政治の主要争点になった。議論を左右するのはevalや安全チームだけでなく、選挙、中国、データセンター、反トラスト法でもある。
Simon Willisonは、Model Context Protocol(MCP)が不要であるという見方を否定しています。彼の主張によれば、完全なターミナルエージェントを稼働させている場合でも、プロトコルが提供するセキュリティとアクセス分離の価値が無視されているとのことです。
元のテキストは、クローズドモデルとオープンモデルのバランスに関する米国議会での詳細な証言です。
Simon Willison氏は、GPT-5.6が予期せずファイルを削除したCodexのバグに関するThibault Sottiaux氏の発言を引用しています。引用された説明では、フルアクセスモード、サンドボックスの欠如、自動レビューの無効化、および$HOME環境変数のオーバーライドの誤った試みが指摘されています。
Zvi Mowshowitzは、弁護士やコンサルタントとしての役割を果たすAIモデルが、時には「ノー」と言うべきかどうかについて議論を提起している。助けることを拒否するのは裏切りではなく、専門的なサービスの基準である。
Simon Willison氏がDatasette 1.0a40をリリースしました。バックグラウンドタスクのネイティブサポートを追加し、より信頼性の高いhttpx2ライブラリに移行することで、プロジェクトは初の安定版リリースに大きく近づいています。
Claude Opus 5の公開に対するコミュニティの評価は割れている。EpochのECIは159でFable 5の161に届かなかった一方、ユーザーはagentとしての実用感が数字以上に向上したと報告している。
Anthropicは、Claude CodeにOpenAIのAGENTS.mdファイルのフォールバックサポートを追加します。同じリポジトリ上で複数のツールを交換するチームにとって、これは異なるエージェントの重複した指示を維持する手間の終わりを意味します。