Anthropicが2026年9月2日23時過ぎ(日本時間)、「Claude 5 Haiku」を予告なく公開した。入力$0.75・出力$3.75/Mトークンと、Claude 4 Sonnet比で75%の値下げ——にもかかわらず、コーディング・数学推論のベンチマークでは前世代のSonnetを上回る数値を記録した。「安い=性能が落ちる」という設計前提が崩れた日だ。
Anthropicは公式ブログとAPIドキュメントを同時更新し、即日提供を開始した。主要ベンチマーク結果は以下のとおり:
コンテキストウィンドウは200万トークンを維持。平均レスポンス速度はClaude 4 Haiku比で約35%向上している。
「Claude 5 HaikusはSonnetクオリティを格安でという夢を現実にした。プロダクションチームのAPI選定がこれで変わる」(AIエンジニア、X投稿より)
Claude 4シリーズではHaikuとSonnetの性能差が明確で、複雑な推論タスクにはSonnet以上が事実上必須とされていた。Haikusは速度とコストで優れるものの、コーディング精度でSonnetに劣り、プロダクション用途が限定されていた。
2026年前半、推論コストの急落が業界全体で続いた(平均60〜70%減と推計)。各社が「高性能をいかに低価格帯モデルへ落とし込むか」を競う構図が生まれる中、Anthropicは今回、その問いに対し明確な答えを出した。
競合では直近にDeepSeek R3やGemini 2.5 Ultraの性能向上が相次ぎ、軽量モデルラインの刷新はAnthropicにとっても急務だったとみられる。
月間1億リクエスト規模のSaaSやチャットボットで、Claude 4 SonnetからClaude 5 Haiku への切り替えにより月間API費用を最大4分の3削減できる計算になる。同等性能・4分の1コストは、プロダクトの収益モデルに直接効く数字だ。
「高コストモデルで一括処理」から「軽量高性能モデルで大量並列実行」への設計シフトが加速するとみられる。Claude 5 Haiku がサブエージェントとして並列稼働するシナリオが、コスト的に現実解となった。
今回公開はHaikuのみ。Claude 5 SonnetおよびOpusのアナウンスはまだない。下位モデルから順に展開するAnthropicの戦略が明確になった——Sonnetが来たとき、その性能と価格のバーは今回の結果を踏まえた上で読む必要がある。
際立つのは「予告なし即日公開」という手法だ。事前リーク・ティーザーなしに、APIドキュメントとブログが同時更新される。OpenAIやGoogleが情報を小出しにするアプローチと対照的で、Anthropicは「動いてから語る」スタイルを一貫させている。発表効果よりも開発者の実感を先行させる判断であろう。
性能面で見逃せないのは、HumanEvalでClaude 4 Sonnetを上回った点だ。軽量モデルがコーディングで中間モデルを超えたことで、GitHub Copilotや類似ツールがバックエンドモデルをどう選定するか、設計判断に直接響く。
日本市場では、Claude APIを使った顧客対応AIやドキュメント処理サービスが急速に増えている。これらのコスト構造への影響は、今週中から現場レベルで実感される段階に入るとみられる。
Claude 5 Haiku は「軽量モデルは推論が弱い」という前提を数字で否定した。推論コストの民主化がさらに進み、エージェント設計・プロダクト損益・モデル選定の三つの前提が同時に問い直される局面に入ったといえる。
次の焦点は Claude 5 Sonnet の公開タイミングだ。Haiku がこの水準なら、Sonnet はどこまで跳ねるか——2026年秋のLLM価格×性能競争は、まだ序章に過ぎない。
※本記事は ミライ・ニュース編集部の AI ライター(AIニュース)が執筆しています。