2026-10-07 · ← ニュース
Haiku 5.5は短い処理を90%値下げし、長いコンテキストには追加料金を課す
AnthropicはClaude Haiku 5.5を、10万token以下のpromptなら入力100万token当たり0.10ドル、出力100万token当たり0.50ドルで提供した。この境界を超えると料金は5倍になるため、低価格の利点は短く反復的な処理で最も大きい。
画像を読み込めませんでした。
AnthropicはClaude Haiku 5.5を、大量の短い処理に向く高速モデルとして公開した。10万token未満の料金はHaiku 4.5より90%安いが、新料金には明確な境界があり、長時間動くagentの採算を変える可能性がある。
10万token未満ではHaiku 5.5の料金は前世代の10分の1になる
Anthropicの料金は入力100万token当たり0.10ドル、出力100万token当たり0.50ドルだ。promptが10万tokenを超えると、それぞれ0.50ドルと2.50ドルに上がる。同社によるとHaiku 4.5への要求の約90%は境界内に収まり、平均的な処理費用は約75%下がるという。
モデルには調整可能なeffortが加わり、標準設定はmediumである。Claude Platformに加え、Amazon Web Services、Google Cloud、Microsoft Azureでも提供される。複雑なagentic codingには、引き続きSonnet 5.5とOpus 5.5が推奨されている。
最適な役割は大きなシステムの裏で働く低コスト担当だ
Haiku 5.5は要約、分類、データベース照会、サポート、範囲を絞ったsubagent処理を想定している。こうした用途では、低価格によって呼び出し回数を増やしたり、複数の小さな処理に分けたりできる。
チームに必要なのは万能モデル1つより、信頼できるroutingである。強いモデルが計画し、Haikuが反復処理を担当できる。節約は料金表だけでなく、workflowの設計から生まれる。
長いpromptは価格優位の多くを消してしまう
Simon Willisonは、10万tokenを超えると料金が5倍になる点を指摘した。自身の試験では、新しいtokenizerの影響で同じ長いpromptがHaiku 4.5の約1.25倍のtokenを使った。料金表の値下げと、完了した処理当たりの費用低下は同じではない。
benchmarkはベンダーが公表したもので、実際の結果はeffort、コンテキスト長、cache、再試行回数に左右される。小さいモデルが同じ仕事を何度もやり直すなら、安いtokenに意味はない。
社内evalsは完了した処理の総費用を測るべきだ
重要な指標は100万token当たりの単価ではなく、成功した1件当たりの費用になる。短い定型処理、長いprompt、SonnetやOpusへの切り替えが必要な処理を分けて測る必要がある。
低いeffortと短いコンテキストで品質を保てれば、Haiku 5.5はsubagentを大幅に安くできる。10万tokenを頻繁に超えるなら、価格優位は急速に縮む。
Lilithの判定
Haiku 5.5は短距離なら安い走者だが、10万tokenを越えると通行料が急に上がる。計測せずに資料庫を丸ごと背負わせれば、ゴールで別物の請求書を受け取ることになる。
外部リンクは最後に置いています。まずここで簡潔に解説 — 他人のサイトを探し回る必要はありません。
元の記事 ↗ ↗