米Anthropicは小型AIモデル「Claude Haiku 5.5」を発表した。
10万トークンまでの入力料金を100万トークンあたり0.10ドルに設定し、Haiku 4.5比で9割引き下げた。
Haiku 5.5、低価格と高速処理を両立
2026年10月7日に発表されたClaude Haiku 5.5は、要約やデータベース照会、分類などの反復処理に加え、カスタマーサポートやブラウザ操作を想定した小型モデルである。AnthropicはHaiku 4.5より平均75%低いコストで運用でき、標準速度では同社最速モデルとしている。
10万トークンまでの入力は100万トークンあたり0.10ドル、出力は0.50ドル。
Haiku 4.5は入力1ドル、出力5ドルだったため、単価は10分の1となった。
10万トークンを超える場合も入力0.50ドル、出力2.50ドルに抑えられている。
実際の作業コストはトークン使用量にも左右されるため、同社は平均75%のコスト低下と説明している。
性能面では、GDPval-AA v2.1で1620、AA-Briefcase v1.1で1578、OSWorld 2.1で72.4%を記録した。Humanity’s Last Examではツールなし45.9%、ツールあり57.4%、Terminal-Bench 4.0では39.2%となった。
さらに「effort setting」をHaikuとして初めて導入し、処理の強度を調整できるようになったという。
Haiku 5.5は、Claude Platformに加え、Amazon Web Services、Google Cloud、Microsoft Azureでも利用できる。
PythonとTypeScriptのSDKでは、コンピューター操作とブラウザ操作にベータ対応している。
AI活用拡大を後押しも、使い分けが重要か
Haiku 5.5の強みは、低価格と高速処理を生かして、高性能モデルから大量の定型処理を切り出しやすくなる点にありそうだ。
要約や分類のような大量処理を小型モデルへ寄せれば、AIエージェントの実行量を増やしながら、全体のコストを抑えられる可能性がある。
一方、低価格だけを理由に複雑な業務まで一律に任せるのは危険だろう。
複雑な推論や高度なエージェント処理では上位モデルが優位になり得るため、品質要件に応じてモデルの選定を行うことは欠かせないはずだ。
誤判定や追加確認が増えれば、見かけの単価低下が実際のコスト削減につながらない可能性もある。
今後は、複数モデルを役割分担させる「モデルルーティング(※)」がAIシステムの設計要素として重要になるだろう。
小型モデルの価格と速度がさらに改善すれば、常時稼働型のAIエージェントや大量処理の実用化を後押しし、競争軸も単体性能から処理全体の費用対効果へ移ると考えられる。
※モデルルーティング:入力内容や処理の難易度に応じて、複数のAIモデルから適切なモデルを選び、処理を振り分ける仕組み。
関連記事:
Anthropicが「Claude for Government」一般提供 FedRAMP High環境で連邦・州政府機関向け

Anthropic、「Claude Sonnet 5.5」発表 Sonnetシリーズ最速・タスクコスト最大30%減

Anthropic、新計量モデル「Claude Haiku 4.5」発表 高性能を3分の1のコストで実現
