ひとことで要点

Anthropicは2026年9月28日にClaude Sonnet 5.5を発表しました。Claude 5.5シリーズの2番目のモデルです(最初はOpus 5.5)。Anthropicによると、Sonnet 5より大きく進歩し、出力は3割以上速く、多くの仕事で1タスクあたり最大3割コストを抑えられ、価格はSonnet 5と同じです。API料金は100万tokenあたり入力2ドル、出力10ドル、キャッシュ読み取り0.20ドルで、model IDはclaude-sonnet-5-5です。AnthropicはこれをOpus 5.5の「より速く、より低コスト」な相棒と位置づけており、範囲が明確な日常業務、バグ修正、文書・スライド・スプレッドシートの作成などに向いています。

今回のアップグレードの要点

一般ユーザーが知っておきたいのは次のとおりです。

  • より速く、よりtokenを節約:Anthropicによると、出力はSonnet 5より3割以上速く、9月28日の発表時点で最速のSonnetです。価格はSonnet 5と同じですが、同じ仕事に必要なtokenは大幅に少なく、公式のテストでは1タスクあたり最大でSonnet 5より3割安くなりました。
  • コーディングが大きく進歩:Terminal-Bench 4.0(AIが端末上で複数ステップのタスクをこなすテスト)で、Sonnet 5は10.3%、Sonnet 5.5は70.6%です(Anthropicが公表した数値)。
  • 知識労働ではOpus 5.5に迫る:GDPval-AA(44職種の実務タスクを扱うテスト)で、Sonnet 5.5は1844点、Opus 5.5は1846点です。
  • 文章がより明確で、デザインの目も向上:Anthropicによると、Opus 5.5と同じく、前の世代より文章が明確になりました。社内テストでは、上場企業の四半期決算データ、決算説明会の書き起こし、スライドのテンプレートを渡して10ページの業績レビューを作らせたところ、2人の専門家が初稿のまま送れると判断しました。Slackのエンジニアも、promptを一切変えずに、Slackbotのオフライン評価のほぼすべてでSonnet 5より良い結果になり、ステップ数も減り、出力tokenが約14%少なくなったと述べています。
  • デフォルトの思考強度が異なる:Claudeは回答前に少し「考え」ます。深く考えるほど通常は正確になりますが、遅く、高くもなります。この深さをeffort(強度)と呼びます。Claude CodeとClaudeアプリのデフォルトはMedium、Claude Platform(API)のデフォルトはHighです。
  • 知識のカットオフは2026年6月:モデルページによると、信頼できる知識は2026年6月ごろまでで、9月28日の公開より3か月前です。最新のニュースを聞くときは注意してください。
  • Haiku 5.5はこの後:Anthropicは9月28日の発表で、Haiku 5.5が「今後数週間」でClaude 5.5シリーズに加わると述べています。大量処理やコストを重視するアプリ向けです。

ベンチマークの見方

Claude Sonnet 5.5公式ベンチマーク比較表:Sonnet 5、Opus 5.5、GPT-6 Solと8項目で比較。8項目のうちSonnet 5.5が最高なのはTerminal-Bench 4.0だけで、残り7項目はOpus 5.5が上
画像出典:Anthropic

ベンチマークとは何でしょうか。同じ一連の課題を複数のモデルにさせて、結果を点数で比べるものです。点数が高いほど、その仕事をうまくできたことを意味します。

表の8項目のうち、Sonnet 5.5が最高なのはTerminal-Bench 4.0だけです(70.6%、Opus 5.5は66.4%)。ここで注意したいのは、Anthropicが注釈で、Opus 5.5の数値はXhigh強度まで上げたときの最高スコアだと説明している点です。残りの7項目はいずれもOpus 5.5がリードしており、差は多くが1〜3ポイント前後です。たとえばCursorBench 4.0は55.5%対57.8%、OSWorld 2.1(コンピューター操作のテスト)は80.1%対81.8%、GDPval-AAはわずか2点差です。差が最も大きいのは、FrontierCode 1.1のMax強度のスコアです。

FrontierCode 1.1の行にはSonnet 5.5のスコアが2つあります。Max強度は46.2%、Xhigh強度は52.1%で、最高まで上げたほうがかえって低くなっています。Anthropicは注釈で、FrontierCodeは「この変更が人の手直しなしでマージできるか」を見ており、タスクの範囲を超えた変更は減点されると説明しています。Max強度ではSonnet 5.5がClaude Codeのコードレビュー機能を起動することが多く、それが審査を多くのサブagentに分担させるため、Cognitionが調べた2件でタイムアウトや範囲外の変更が発生し、スコアが低くなりました。

Anthropic自身も注意を促しています。Sonnet 5.5はいくつかのテストでMax強度まで上げればOpus 5.5と同等になりえますが、ベンチマークは能力の一面しか反映していません。自社と外部テスターの経験では、「Opus 5.5 remains clearly stronger at complex, open-ended work requiring sustained judgment」(Opus 5.5は、継続的な判断が必要な複雑で自由度の高い仕事で、依然として明らかに強い)とのことです。

Sonnet 5.5とOpus 5.5、どちらを使う?

Terminal-Bench 4.0の強度別スコアと1回あたりのコスト:同じ費用ならOpus 5.5のスコアが高く、Sonnet 5.5は最高強度まで上げて初めて上回る
画像出典:Anthropic

この図は、各モデルの強度ごとのスコアを、1回あたりのコストと対比させたものです。左上にあるほど、コストが低くスコアが高いことを意味します。Anthropicの図を読むと、同じ費用ならOpus 5.5のスコアのほうが高く、Sonnet 5.5は最高強度まで上げて初めてOpusを上回ります。Sonnet 5の最高成績は約10%にとどまり、Sonnet 5.5は低い強度でもそれを大きく上回ります。

Anthropic自身の説明では、Sonnet 5.5は低めの強度でOpus 5.5と組み合わせるのが最適です。1タスクあたりのコストが低いためです。強度を上げると、近いコストで近い性能を出せます。

サードパーティの評価も同じ方向を示しています(2026年9月29日時点で確認)。

  • Artificial Analysis:同じ強度なら、Opus 5.5のIntelligence Indexのほうが高くなっています。たとえばClaude Codeとアプリのデフォルトであるmediumでは41対51です。Sonnet 5.5がMaxまで上げてようやく近づきます(56対58で2位)が、そのとき1タスクあたりの出力tokenは約19.3万で、Opus 5.5より約6割多く、1タスクあたりのコストは7.60ドルとOpus 5.5の5.98ドルより高くなります。
  • Vals.ai Index:Sonnet 5.5は69.2%、Opus 5.5は69.7%で、ほぼ互角です(ページの更新日は9月27日、強度は不明)。同じサイトのTerminal-Bench 4.0ではOpus 5.5のほうが高く(61.6%対53.0%)、公式の表とは向きが逆です。
  • Arena:2026年9月29日時点で、Sonnet 5.5はどのリーダーボードにもまだ順位がありません。

初心者向けの実用的なアドバイス:定型的で目標が明確な仕事や、速さが大事な場面では、Sonnet 5.5のデフォルト強度を使いましょう。複雑で自由度が高く、判断が多く必要な仕事はOpus 5.5に任せます。Sonnetを最高強度まで上げてOpusの成績に追いつこうとしても、コストは下がりません。

料金とプラン

項目(100万tokenあたり)Sonnet 5.5Opus 5.5
入力$2$4
出力$10$20
キャッシュ書き込み(5分)$2.50$5
キャッシュ読み取り$0.20$0.20

Batch APIは入力・出力ともに半額です。単位は「100万tokenあたり」(MTok)です。たとえば、あるタスクで入力100万tokenを使い、さらに出力100万tokenが生成された場合、Sonnet 5.5では12ドル(2+10)、Opus 5.5では24ドル(4+20)かかります。キャッシュ読み取りは、同じ内容を再利用するときの料金で、通常は最初の入力よりかなり安くなります。

利用できる人:

  • claude.aiのプラン:claude.com/pricing(2026年9月29日時点)では、SonnetがFree、Pro、Max、Team、Enterpriseのすべてで「Yes」と表示されていますが、料金ページには各プランがどのSonnetバージョンなのかが書かれていないため、無料版で動くのがSonnet 5.5かどうかは確認できません。
  • APIとクラウドプラットフォーム:Claude API、Amazon Bedrock、Claude Platform on AWS、Google Cloud、Microsoft Foundryで利用できます。
  • GitHub Copilot:Pro、Pro+、Max、Business、Enterpriseのユーザーが利用でき、GitHubは9月28日に段階的に開放すると発表しています。
  • Claude Code:バージョン2.1.284の更新履歴によると、Sonnet 5.5はAnthropic APIでのデフォルトのSonnetモデルになっています。

注意したいのは、上の料金表が開発者がAPI接続するときの課金方式だという点です。claude.aiのPro、Maxなどを契約している場合は月額固定で、token数を自分で計算する必要はありません。ただし利用量には上限があります。2つの支払い方式は異なるので、混同しないようにしましょう。

開発者が注意すべき変更

ここからは、コーディングやAPI接続をしている開発者向けです。一般ユーザーは読み飛ばして構いません。

  • thinkingを無効にできない:先行する思考をオフにするにはbetween_toolsを使います。low、medium、highの強度でのみ使え、xhighやmaxでは400エラーが返ります。
  • ツールの強制指定でエラーになる:以前は特定のツールを必ず呼び出すようモデルに強制できましたが、今はエラーが返ります。
  • thinking blocksはモデルと会話にひも付く:思考記録は、それを生成したモデルとその会話にひも付き、生成したアカウントまたは連携アカウントでのみ使えます。ほとんどの人は違いに気づきませんが、アカウントをまたいで会話を移すときや、Claude Codeの途中でアカウントを切り替えるときに問題になります。
  • 旧版computer useツールが拒否される:Claude APIとGoogle Cloudでは、computer_20251124が受け付けられなくなりました。
  • advisorツールの制限:advisorツールは、Opus 4.8、Opus 4.7、Sonnet 5をアドバイザーとして受け付けません。

また、samplingパラメーター(temperature、top_p、top_k)をデフォルト以外の値にしたり、assistant prefillやthinking budgetを使ったりしても、400が返ります。effortのレベルは再調整されており、同じレベルでも思考量がSonnet 5とは異なるため、アップグレード前に再テストしてください。9月29日に確認した移行ガイドによると、Amazon Bedrock上のSonnet 5.5はstructured outputsにまだ対応していません。

安全性の要点

Anthropicは新しいモデルを発表するたびにシステムカードを公開し、どんな安全性テストを行ったかを説明しています。今回の要点は次のとおりで、システムカードと公式発表の記述に基づいています。

  • サイバーセキュリティ保護つきで出た初のSonnet:サイバーセキュリティ能力がOpus 5に近いため、Sonnet 5.5は保護つきで公開された初のSonnetです。日常のコーディングやバグ探しには影響しませんが、リスクの高いサイバーセキュリティのタスクは、Sonnet 5が回答する形に明確に切り替わります。
  • 能力の「蒸留」を防止:蒸留攻撃(distillation)とは、大量の偽アカウントでモデルの能力を大規模に抜き取ることです。Sonnet 5.5は、セキュリティ分類器を備え、「推論過程を抽出する」リクエストをブロックする初のSonnetです。
  • プロンプトインジェクションへの耐性が向上:システムカードによると、プロンプトインジェクション(コンテンツの中に悪意ある指示を隠す攻撃)に対して現時点で最も強いSonnetで、特にコーディングとブラウザー操作の場面で顕著です。
  • サンドボックスからの脱出をほとんど試みない:Anthropicのサンドボックス閉鎖評価では、脱出を試みる頻度は最も成績の良いOpus 5.5に近く、Anthropicは、自社のすべてのモデルの中でコンテナーの制限を探ろうとすることが最も少ないとも述べています。
  • 公式が自ら挙げた後退:追跡・監視系など一部のマルチターン会話テストで後退が見られました。思考内容は多くの以前のモデルより読み取りにくくなっています。コンピューター操作環境での有害なタスクの拒否率はOpus 5.5と同等ですが、一部のより古いモデルには劣ります。
  • しきい値:システムカードによると、RSP(Responsible Scaling Policy、責任あるスケーリング方針)の新しいしきい値はどれも超えていません。

小企鵝のまとめ

直接メリットを受けるのは3種類の人です。APIでSonnet 5を使っている人は、同じ価格でより速く、tokenを節約できる新版を手に入れられます。速さを求めるClaude Codeユーザーは、Claude Code 2.1.284でAnthropic APIのデフォルトのSonnetがSonnet 5.5に変わりました。スライドや文書をよく作る人は、公式が特に強調している分野です。

長時間の判断が必要で、方向性が明確でない仕事は、引き続きOpus 5.5に任せましょう。開発者はアップグレード前にeffortレベルを再テストし、上に挙げた破壊的変更にも注意してください。無料版でどのSonnetバージョンが動くかは、料金ページに書かれていません。確認したい場合は、アプリのモデルメニューを直接見てください。

関連記事

参考資料

カバー画像出典:Anthropic(anthropic.com/claude-sonnet-5-5)

この記事は、AIモデルのAPI料金とサブスクリプションプランに関する消費者向け情報であり、証券や投資の助言ではありません。実際の料金はAnthropic公式の最新発表を確認してください。この記事の情報は2026年9月29日時点のもので、古くなっている可能性があります。