Anthropic⁠⁠、Claude Sonnet 5.5を発表 —⁠—Sonnet 5比で出力を30%高速化⁠⁠、タスク当たりの費用は最大30%減

Anthropicは9月28日、AIモデル「Claude Sonnet 5.5」を発表した。Claude 5.5ファミリーの第2弾となり、同社によると、Sonnet 5と比べて出力生成の速度が30%を超えて向上し、Sonnetモデルで最速となった。トークン単価は据え置きながら、同じ作業に必要なトークン数を減らし、同社のテストではSonnet 5と比べてタスク当たりの費用を最大30%削減したという。

なお、先行して登場したOpus 5.5については、発表当時の別記事で性能や料金、安全対策を詳しく取り上げている。Anthropicは、今後数週間以内にClaude Haiku 5.5も提供する予定としている。

料金はSonnet 5と同じ⁠、Claude Codeでも利用可能

Claude Sonnet 5.5の料金は100万トークン当たり入力2ドル、出力10ドルで、Sonnet 5と同じ。Opus 5.5は入力4ドル、出力20ドルのため、Sonnet 5.5の入出力単価はその半額となる。キャッシュ読み出しはSonnet 5、Sonnet 5.5、Opus 5.5のいずれも100万トークン当たり0.20ドル。

同社は、モデルの思考量を調整するエフォートの設定ごとに、ベンチマークの性能と費用も比較した。複数のベンチマークで、Sonnet 5.5はLowまたはMediumでもSonnet 5の最高スコアを上回ったという。その際の費用は、Sonnet 5が最高スコアを出した設定での約10分の1だった。

Sonnet 5.5のコンテキストウィンドウは100万トークン。公式モデル一覧によると、信頼できる知識のカットオフと学習データのカットオフは、いずれも2026年6月で、Opus 5.5と同じとなる。

Claude Codeではv2.1.284以降、Claude API利用時のsonnetエイリアスがSonnet 5.5を指す。なお、Claude CodeのデフォルトモデルはOpus 5.5のままで、/model sonnetで切り替えることになる。

Claude Codeでのエフォートの既定値はMedium。Sonnet 5.5の思考をオフにすることはできず、思考量はエフォートで調整する。fast modeには対応しない。

Terminal-Bench 4.0で70.6%⁠、Sonnet 5から大幅に改善

ターミナルやコマンドライン環境での作業能力を評価するTerminal-Bench 4.0では、Sonnet 5.5は70.6%を記録し、同社が公表したSonnet 5の10.3%を大きく上回った[1]。

日常的な開発や文書作成に推奨⁠、Opus 5.5との使い分けも案内

Anthropicは、仕様が明確で結果を検証できる日常的な作業にSonnet 5.5を勧めている。開発者向けガイド「Building with Claude Sonnet 5.5」では、バグ修正や機能の改良を素早く繰り返す作業に加え、文書・スライド・スプレッドシートの作成を得意分野に挙げた。

デザイン面では、ユーザーインターフェースの見栄えを整えたり、テンプレートに沿って手直しが少なくて済むスライドを作成したりする能力を紹介している。生成する文章も、同社の前世代モデルより明瞭になったという。

公式Xでは、Sonnet 5.5を使った作例として、紅葉のシミュレーターや手描き風のフローチャートツールなどを紹介した。フローチャートツールでは、図形をドラッグして接続したり、図の上に描き込んだりできるという。

また、AnthropicのEdwin Arbus氏は、Sonnet 5とSonnet 5.5が「はい/いいえ」で答えられる質問を重ね、20問以内で絵文字を当てようとするデモを紹介している。このデモでは、Sonnet 5.5はSonnet 5よりも所要時間が短く、費用と使用トークン数も少なくなっている。

一方、Anthropicは慎重な判断を要する複雑な作業や、難度の高い長時間の作業にはOpus 5.5を勧めている。Sonnet 5.5でもエフォートを高くすると思考時間と費用が増えるため、必要な品質が得られるか評価し、Opus 5.5の利用も検討するように述べている。

エフォートの設定による違いは、コード変更を評価するFrontierCode v1.1の結果にも表れている。この評価では、モデルが作成したコードの変更を、開発者が手直しせずにマージできるかを重視し、依頼範囲外の変更は有用でも減点する。システムカードに掲載されたCognitionの評価結果では、課題セット「Main」でSonnet 5.5はXhighで52.1%だったのに対し、Maxでは46.2%だった。

Anthropicは、エフォートの調整や作業範囲の指定、コード変更後の検証などを扱うSonnet 5.5向けプロンプトガイドも公開している。

サイバー対策を追加⁠、ブロック時は別モデルで再試行も

Anthropicは安全性について、自動化した行動監査で、利用者の意図に沿う振る舞いや誠実さに関する多くの指標がSonnet 5と同等以上だったと述べている。

また、Sonnetシリーズで初めて、Opus 5やOpus 5.5と同じ方針に基づくサイバーセキュリティ向け保護措置を導入した。通常のソフトウェア開発の大半には影響しないとする一方、システムカードでは、無害なサイバーセキュリティ関連作業でもSonnet 5より拒否が増える見込みを示している。ソースコードの脆弱性発見は許可するが、コンパイル済みバイナリの脆弱性発見はブロックする方針となる。

Anthropicの自社アプリでは、サイバー対策で要求がブロックされると、処理するモデルをSonnet 5へ自動的に切り替える。Claude APIでは、開発者がベータ機能のfallbacks: "default"を指定すると、拒否された要求の一部をSonnet 5で再試行する。対象は、サイバー攻撃につながる要求などを示すcyberか、競合AIモデルの開発支援に関わるfrontier_llmとして拒否された要求に限られる。

APIの提供先と⁠、Sonnet 5からの移行時の注意点

Sonnet 5.5は提供を開始しており、Claude API、Amazon Bedrock、Claude Platform on AWS、Google Cloud、Microsoft Foundryで利用できる。Microsoft Foundryでの提供は、モデルの配置方式のうち「Global Standard」に限られる。Claude APIでのモデルIDはclaude-sonnet-5-5となる。

APIでSonnet 5から移行する場合には、モデルIDの変更に加えて、既存の設定も確認する必要がある。移行ガイドによると、思考を無効にする従来のthinking.type: "disabled"はSonnet 5.5ではエラーになる。処理開始時の思考を省き、ツール呼び出しの間だけ思考させるには、between_toolsを使う。この場合、エフォートはLow、Medium、Highのいずれかに設定する。

また、ツール呼び出しを強制するtool_choiceのanyとtoolもサポートされず、指定するとエラーになる。移行ガイドでは、このほか会話履歴やcomputer use、応答に含まれる思考ブロックの扱いなど、確認すべき変更点を案内している。

おすすめ記事

記事・ニュース一覧