Anthropic⁠⁠、Claude Haiku 5.5を発表—⁠—実行コストはHaiku 4.5比で平均約75%減⁠⁠、OSWorld 2.1のオフライン評価で72.4%⁠⁠、Sonnet 5.5は83.9%

Anthropicは10月7日、AIモデル「Claude Haiku 5.5」を発表した。コーディング、コンピューター操作、知識労働でHaiku 4.5から性能を高め、実行コストは平均で約75%低くなるとしている。

Haiku 5.5はClaude PlatformとClaude Codeで利用できる。Amazon Web Services、Google Cloud、Microsoft Azureでも提供を開始した。

大量の反復処理やサブエージェントでの利用を想定

Haiku 5.5は、要約、分類、会話履歴の圧縮、データベースへの問い合わせといった範囲の限られた作業を、低コストで大量に処理する用途に向けたモデル。Anthropicは、コーディングでOpus 5.5やSonnet 5.5と組み合わせ、作業の一部を任せるサブエージェントとしての利用も挙げている。

標準速度で動作する同社のモデルの中では最も高速で、リアルタイムの顧客対応やブラウザー操作にも適するという。

コンテキストウィンドウはHaiku 4.5の20万から100万トークンへ、最大出力は6万4000から12万8000トークンへ拡大した。モデルカードでは、知識カットオフと学習データのカットオフをともに2026年6月としている。

思考の必要性や量をモデルが判断するAdaptive thinkingが標準で有効になった。Haikuシリーズでは初めてeffort設定に対応し、タスクに応じてコストと性能のバランスを調整できる。既定値はmedium。

Terminal-Bench 4.0とOSWorld 2.1でHaiku 4.5を上回る

同社によると、コマンドライン上で複数の手順を要する複雑な作業の遂行能力を測るTerminal-Bench 4.0で、Haiku 5.5は39.2%を記録した。Haiku 4.5は0.0%、Sonnet 5.5は70.6%だった。なお、Anthropicは、Terminal-Bench 4.0で評価するような複雑なコーディング作業には、引き続きSonnet 5.5やOpus 5.5が適していると説明している。

コンピューター操作の能力を測るOSWorld 2.1では、オフラインの評価対象に限ったスコアが、Haiku 5.5で72.4%、Haiku 4.5で15.7%、Sonnet 5.5で83.9%だった。

安全性に関わるアラインメント評価についても、同社はほぼすべての項目でHaiku 4.5から改善したと報告している。悪用に協力しようとする傾向も低下したという。評価の詳細を記したシステムカードも公開している。

プロンプトが10万トークン以下なら入力100万トークン当たり0.10ドル

Haiku 5.5の単価は、1回のリクエストに含まれるプロンプトが10万トークン以下か、10万トークンを超えるかで変わる。主な料金は次のとおりで、いずれも100万トークン当たり。

料金項目 プロンプトが10万トークン以下 プロンプトが10万トークン超
入力 0.10ドル 0.50ドル
出力 0.50ドル 2.50ドル
キャッシュ読み取り 0.01ドル 0.05ドル

キャッシュ読み取り料金は、保存済みの入力を再利用する際にかかる。

Anthropicによると、Haiku 4.5へのリクエストの約90%では、プロンプトが10万トークン以下だった。Haiku 5.5は、この範囲の処理で特に費用対効果が高いという。

同社が示した平均約75%という実行コストの削減率は、単価の引き下げと、同じ作業に使うトークン数の変化を踏まえている。開発者向け資料によると、テキストをトークンに分割するトークナイザーの更新に伴い、同じ入力テキストのトークン数はHaiku 4.5より約30%増える。

Haiku 4.5からの移行ガイドと専用プロンプトガイドも

Claude APIのモデルIDはclaude-haiku-5-5。Haiku 4.5からの移行には、モデルIDの変更に加え、APIの設定や実装の見直しが必要な場合がある。思考量をbudget_tokensで指定していた場合は、Adaptive thinkingへ切り替える必要がある。また、assistantメッセージの続きを生成させるprefillは利用できない。詳しい変更点と対応方法は移行ガイドで確認できる。

Haiku 5.5用のプロンプトガイドも公開した。effortの選択、検索やツールの利用、コード変更後の検証などについて、モデル固有の挙動に応じた指示の書き方を紹介している。

Sonnet 5.5のキャッシュ値下げと月額APIクレジットも

あわせて、Sonnet 5.5のキャッシュ読み取り料金を100万トークン当たり0.20ドルから0.10ドルへ半額に引き下げた。Anthropicは、長時間にわたるエージェントの作業の多くで、実行コストが約20%下がるとしている。

また、MaxおよびTeamプランの契約者には、Claude PlatformのAPI利用料に充てられるクレジットを順次提供する。Haiku 5.5を含む各モデルで利用できる。

毎月の付与額はMax 5xが100ドル、Max 20xが200ドル。TeamではStandardシート当たり20ドル、Premiumシート当たり100ドルを合算し、チーム全体で月額最大500ドルを共有する。未使用分は次の請求期間へ繰り越せない。

ヘルプセンターの案内によると、クレジットを受け取るには、契約プランとClaude Console組織を連携させる必要がある。新規加入者は、対象プランへの加入から7日が経過した後に受け取り手続きを行える。

クレジットは、Claude Codeの対話利用や、Claude、Claude Code、Claude Coworkで利用上限を超えた際の追加利用には使えない。Amazon Bedrock、Google Cloud Vertex AI、Microsoft Foundry経由の利用も対象外となる。

おすすめ記事

記事・ニュース一覧