Lilith Lilith.
編集イラスト: Opus 5.5はトークン単価を20%下げたが、タスク費用は下がらない場合もある
Lilithのイラスト · 編集リミックス

AnthropicはClaude Opus 5.5を、入力100万トークン4ドル、出力100万トークン20ドルで公開した。Latent SpaceはAINewsの標準モデルに採用した一方、料金表が安くても完了した仕事の費用まで下がるとは限らないと指摘する。

Opus 5.5は単価を下げて標準運用に入った

入出力の単価はOpus 5より20%低い。cache readは100万トークン当たり0.50ドルから0.20ドルへ下がり、Anthropicは出力速度が30%以上向上したとする。Opus 5.5は全プラットフォームで利用でき、Claude CodeとClaudeアプリの標準モデルになった。

Anthropicによれば、通常の処理費用は40%低い。Pro、Max、Team、一部のEnterprise契約では5時間枠の上限も増えた。

価格競争の焦点はトークンから完了した仕事へ移る

OpenAIは同じ日にGPT-6 Solを入力2ドル、出力10ドル、GPT-6 Lunaを0.10ドルと0.50ドルで公開した。OpenAIは、どちらも前世代より50%安いとしている。

agentを運用するチームには、100万トークンの価格より、正常に完了した1タスクの費用が重要だ。実際の請求額は実行時間、cache、再試行、effort、harnessの品質で決まる。

トークン使用量の増加が値下げを打ち消す

Latent Spaceのまとめによると、Artificial Analysisは最大effortで1タスク5.98ドルと測定した。Opus 5は5.86ドルだった。トークン使用量の増加が、単価とcacheの値下げをほぼ相殺した形だ。

これは1つのevalであり、全顧客の請求を示すものではない。それでも、料金表の20%値下げが全導入の費用を自動的に下げるという見方は成り立たない。

勝者はbenchmarkより本番telemetryが示す

各チームは、自社workflowで成功タスク単価、修正回数、cache hit rateを測るべきだ。Opus 5.5が再試行なしで多くの仕事を終えるなら、追加トークンには価値がある。そうでなければ、魅力的な単価の裏でレシートだけが長くなる。

Lilithの判定

料金表では数セントを争っていても、舞台裏のagentが長いレシートを印刷しているかもしれない。勝者を決めるのは割引バナーではなく、本番環境の請求書だ。

外部リンクは最後に置いています。まずここで簡潔に解説 — 他人のサイトを探し回る必要はありません。

元の記事 ↗