Lilith Lilith.
編集イラスト: Opus 5.5とGPT-6 Luna、革新よりも価格を引き下げ
Lilithのイラスト · 編集リミックス

最も賢いモデルを巡る競争は、経済的現実に直面しました。企業は、日常業務に最先端のモデルを展開するのは費用がかかりすぎるため、小規模で安価なオープンウェイトモデルにクエリをルーティングする実験を始めていました。今週の2つの重要な発表は、主要プレイヤーが企業顧客をどう引き留めようとしているかを示しています。

驚異的なベンチマークよりもコスト削減を重視

Anthropicは、複雑な知識タスクやコーディングのための主力モデルの最新版、Opus 5.5を発表しました。OpenAIは、スピードに焦点を当てたより効率的なモデルであるGPT-6 SolとLunaで対抗します。共通点は能力の飛躍的な向上ではなく、価格の低下です。

大幅な割引が長時間稼働するエージェントの計算を塗り替える

ベンチマークでは、Opus 5.5が最近リリースされたGPT-6 Astraをわずかに上回っていますが、本当の魅力は価格表にあります。Anthropicは、入力および出力トークンの価格をそれぞれ100万あたり4ドルと20ドルに引き下げました。これはOpus 5から20%の下落です。

重要なニュースは、キャッシュ読み取りコストが100万トークンあたり0.20ドルへと60%削減されたことです。これらの操作は、長期間稼働するエージェントタスクのコストの大半を占めるため、Opus 5.5は、以前であれば予算を食い潰していた反復的な問題解決により多くの余裕をもたらします。

安価なフロンティアモデルではベンダーロックインは解決しない

注意点として、トッププロバイダーの安価なAPIは、自社インフラを所有する利点を一時的に覆い隠すに過ぎない可能性があります。顧客は依然として閉鎖的なインターフェース上に構築しており、プロンプトを書き換えることなく別のモデルにワークロードを移行する柔軟性を欠いています。

Opus 5.5は生成速度が30%速いと約束していますが、現実の企業環境での運用により、ピーク負荷時や複雑なクエリの際にこの数字がどれほど維持されるかが明らかになるでしょう。

ベンダーの物語から外れた採用が変化を決定づける

企業がこれらの割引にどう反応するかによって、真の影響がわかります。もし顧客がモデルルーターを備えた複雑なシステムを放棄し、低コストを理由に再び単一のベンダーの盲目的な利用に戻り始めたら、AnthropicとOpenAIの賭けは報われたことになります。そうでなければ、私たちは避けられないコモディティ化の前の時間稼ぎを見ているに過ぎません。

Lilithの判定

AGIの探求の代わりに、我々が得たのは中低価格帯の価格競争でした。勝者は、より安価なバージョンにはもはや専任のプロンプト最適化チームが必要ないことをCFOに最初に納得させた者です。

外部リンクは最後に置いています。まずここで簡潔に解説 — 他人のサイトを探し回る必要はありません。

元の記事 ↗