ひとことで要点
Anthropicは2026年9月28日にClaude Sonnet 5.5を発表しました。Claude 5.5シリーズの2番目のモデルです(最初はOpus 5.5)。Anthropicによると、Sonnet 5より大きく進歩し、出力は3割以上速く、多くの仕事で1タスクあたり最大3割コストを抑えられ、価格はSonnet 5と同じです。API料金は100万tokenあたり入力2ドル、出力10ドル、キャッシュ読み取り0.20ドルで、model IDはclaude-sonnet-5-5です。AnthropicはこれをOpus 5.5の「より速く、より低コスト」な相棒と位置づけており、範囲が明確な日常業務、バグ修正、文書・スライド・スプレッドシートの作成などに向いています。
今回のアップグレードの要点
一般ユーザーが知っておきたいのは次のとおりです。
- より速く、よりtokenを節約:Anthropicによると、出力はSonnet 5より3割以上速く、9月28日の発表時点で最速のSonnetです。価格はSonnet 5と同じですが、同じ仕事に必要なtokenは大幅に少なく、公式のテストでは1タスクあたり最大でSonnet 5より3割安くなりました。
- コーディングが大きく進歩:Terminal-Bench 4.0(AIが端末上で複数ステップのタスクをこなすテスト)で、Sonnet 5は10.3%、Sonnet 5.5は70.6%です(Anthropicが公表した数値)。
- 知識労働ではOpus 5.5に迫る:GDPval-AA(44職種の実務タスクを扱うテスト)で、Sonnet 5.5は1844点、Opus 5.5は1846点です。
- 文章がより明確で、デザインの目も向上:Anthropicによると、Opus 5.5と同じく、前の世代より文章が明確になりました。社内テストでは、上場企業の四半期決算データ、決算説明会の書き起こし、スライドのテンプレートを渡して10ページの業績レビューを作らせたところ、2人の専門家が初稿のまま送れると判断しました。Slackのエンジニアも、promptを一切変えずに、Slackbotのオフライン評価のほぼすべてでSonnet 5より良い結果になり、ステップ数も減り、出力tokenが約14%少なくなったと述べています。
- デフォルトの思考強度が異なる:Claudeは回答前に少し「考え」ます。深く考えるほど通常は正確になりますが、遅く、高くもなります。この深さをeffort(強度)と呼びます。Claude CodeとClaudeアプリのデフォルトはMedium、Claude Platform(API)のデフォルトはHighです。
- 知識のカットオフは2026年6月:モデルページによると、信頼できる知識は2026年6月ごろまでで、9月28日の公開より3か月前です。最新のニュースを聞くときは注意してください。
- Haiku 5.5はこの後:Anthropicは9月28日の発表で、Haiku 5.5が「今後数週間」でClaude 5.5シリーズに加わると述べています。大量処理やコストを重視するアプリ向けです。
ベンチマークの見方

ベンチマークとは何でしょうか。同じ一連の課題を複数のモデルにさせて、結果を点数で比べるものです。点数が高いほど、その仕事をうまくできたことを意味します。
表の8項目のうち、Sonnet 5.5が最高なのはTerminal-Bench 4.0だけです(70.6%、Opus 5.5は66.4%)。ここで注意したいのは、Anthropicが注釈で、Opus 5.5の数値はXhigh強度まで上げたときの最高スコアだと説明している点です。残りの7項目はいずれもOpus 5.5がリードしており、差は多くが1〜3ポイント前後です。たとえばCursorBench 4.0は55.5%対57.8%、OSWorld 2.1(コンピューター操作のテスト)は80.1%対81.8%、GDPval-AAはわずか2点差です。差が最も大きいのは、FrontierCode 1.1のMax強度のスコアです。
FrontierCode 1.1の行にはSonnet 5.5のスコアが2つあります。Max強度は46.2%、Xhigh強度は52.1%で、最高まで上げたほうがかえって低くなっています。Anthropicは注釈で、FrontierCodeは「この変更が人の手直しなしでマージできるか」を見ており、タスクの範囲を超えた変更は減点されると説明しています。Max強度ではSonnet 5.5がClaude Codeのコードレビュー機能を起動することが多く、それが審査を多くのサブagentに分担させるため、Cognitionが調べた2件でタイムアウトや範囲外の変更が発生し、スコアが低くなりました。
Anthropic自身も注意を促しています。Sonnet 5.5はいくつかのテストでMax強度まで上げればOpus 5.5と同等になりえますが、ベンチマークは能力の一面しか反映していません。自社と外部テスターの経験では、「Opus 5.5 remains clearly stronger at complex, open-ended work requiring sustained judgment」(Opus 5.5は、継続的な判断が必要な複雑で自由度の高い仕事で、依然として明らかに強い)とのことです。
Sonnet 5.5とOpus 5.5、どちらを使う?

この図は、各モデルの強度ごとのスコアを、1回あたりのコストと対比させたものです。左上にあるほど、コストが低くスコアが高いことを意味します。Anthropicの図を読むと、同じ費用ならOpus 5.5のスコアのほうが高く、Sonnet 5.5は最高強度まで上げて初めてOpusを上回ります。Sonnet 5の最高成績は約10%にとどまり、Sonnet 5.5は低い強度でもそれを大きく上回ります。
Anthropic自身の説明では、Sonnet 5.5は低めの強度でOpus 5.5と組み合わせるのが最適です。1タスクあたりのコストが低いためです。強度を上げると、近いコストで近い性能を出せます。
サードパーティの評価も同じ方向を示しています(2026年9月29日時点で確認)。
- Artificial Analysis:同じ強度なら、Opus 5.5のIntelligence Indexのほうが高くなっています。たとえばClaude Codeとアプリのデフォルトであるmediumでは41対51です。Sonnet 5.5がMaxまで上げてようやく近づきます(56対58で2位)が、そのとき1タスクあたりの出力tokenは約19.3万で、Opus 5.5より約6割多く、1タスクあたりのコストは7.60ドルとOpus 5.5の5.98ドルより高くなります。
- Vals.ai Index:Sonnet 5.5は69.2%、Opus 5.5は69.7%で、ほぼ互角です(ページの更新日は9月27日、強度は不明)。同じサイトのTerminal-Bench 4.0ではOpus 5.5のほうが高く(61.6%対53.0%)、公式の表とは向きが逆です。
- Arena:2026年9月29日時点で、Sonnet 5.5はどのリーダーボードにもまだ順位がありません。
初心者向けの実用的なアドバイス:定型的で目標が明確な仕事や、速さが大事な場面では、Sonnet 5.5のデフォルト強度を使いましょう。複雑で自由度が高く、判断が多く必要な仕事はOpus 5.5に任せます。Sonnetを最高強度まで上げてOpusの成績に追いつこうとしても、コストは下がりません。
料金とプラン
| 項目(100万tokenあたり) | Sonnet 5.5 | Opus 5.5 |
|---|---|---|
| 入力 | $2 | $4 |
| 出力 | $10 | $20 |
| キャッシュ書き込み(5分) | $2.50 | $5 |
| キャッシュ読み取り | $0.20 | $0.20 |
Batch APIは入力・出力ともに半額です。単位は「100万tokenあたり」(MTok)です。たとえば、あるタスクで入力100万tokenを使い、さらに出力100万tokenが生成された場合、Sonnet 5.5では12ドル(2+10)、Opus 5.5では24ドル(4+20)かかります。キャッシュ読み取りは、同じ内容を再利用するときの料金で、通常は最初の入力よりかなり安くなります。
利用できる人:
- claude.aiのプラン:claude.com/pricing(2026年9月29日時点)では、SonnetがFree、Pro、Max、Team、Enterpriseのすべてで「Yes」と表示されていますが、料金ページには各プランがどのSonnetバージョンなのかが書かれていないため、無料版で動くのがSonnet 5.5かどうかは確認できません。
- APIとクラウドプラットフォーム:Claude API、Amazon Bedrock、Claude Platform on AWS、Google Cloud、Microsoft Foundryで利用できます。
- GitHub Copilot:Pro、Pro+、Max、Business、Enterpriseのユーザーが利用でき、GitHubは9月28日に段階的に開放すると発表しています。
- Claude Code:バージョン2.1.284の更新履歴によると、Sonnet 5.5はAnthropic APIでのデフォルトのSonnetモデルになっています。
注意したいのは、上の料金表が開発者がAPI接続するときの課金方式だという点です。claude.aiのPro、Maxなどを契約している場合は月額固定で、token数を自分で計算する必要はありません。ただし利用量には上限があります。2つの支払い方式は異なるので、混同しないようにしましょう。
開発者が注意すべき変更
ここからは、コーディングやAPI接続をしている開発者向けです。一般ユーザーは読み飛ばして構いません。
- thinkingを無効にできない:先行する思考をオフにするには
between_toolsを使います。low、medium、highの強度でのみ使え、xhighやmaxでは400エラーが返ります。 - ツールの強制指定でエラーになる:以前は特定のツールを必ず呼び出すようモデルに強制できましたが、今はエラーが返ります。
- thinking blocksはモデルと会話にひも付く:思考記録は、それを生成したモデルとその会話にひも付き、生成したアカウントまたは連携アカウントでのみ使えます。ほとんどの人は違いに気づきませんが、アカウントをまたいで会話を移すときや、Claude Codeの途中でアカウントを切り替えるときに問題になります。
- 旧版computer useツールが拒否される:Claude APIとGoogle Cloudでは、
computer_20251124が受け付けられなくなりました。 - advisorツールの制限:advisorツールは、Opus 4.8、Opus 4.7、Sonnet 5をアドバイザーとして受け付けません。
また、samplingパラメーター(temperature、top_p、top_k)をデフォルト以外の値にしたり、assistant prefillやthinking budgetを使ったりしても、400が返ります。effortのレベルは再調整されており、同じレベルでも思考量がSonnet 5とは異なるため、アップグレード前に再テストしてください。9月29日に確認した移行ガイドによると、Amazon Bedrock上のSonnet 5.5はstructured outputsにまだ対応していません。
安全性の要点
Anthropicは新しいモデルを発表するたびにシステムカードを公開し、どんな安全性テストを行ったかを説明しています。今回の要点は次のとおりで、システムカードと公式発表の記述に基づいています。
- サイバーセキュリティ保護つきで出た初のSonnet:サイバーセキュリティ能力がOpus 5に近いため、Sonnet 5.5は保護つきで公開された初のSonnetです。日常のコーディングやバグ探しには影響しませんが、リスクの高いサイバーセキュリティのタスクは、Sonnet 5が回答する形に明確に切り替わります。
- 能力の「蒸留」を防止:蒸留攻撃(distillation)とは、大量の偽アカウントでモデルの能力を大規模に抜き取ることです。Sonnet 5.5は、セキュリティ分類器を備え、「推論過程を抽出する」リクエストをブロックする初のSonnetです。
- プロンプトインジェクションへの耐性が向上:システムカードによると、プロンプトインジェクション(コンテンツの中に悪意ある指示を隠す攻撃)に対して現時点で最も強いSonnetで、特にコーディングとブラウザー操作の場面で顕著です。
- サンドボックスからの脱出をほとんど試みない:Anthropicのサンドボックス閉鎖評価では、脱出を試みる頻度は最も成績の良いOpus 5.5に近く、Anthropicは、自社のすべてのモデルの中でコンテナーの制限を探ろうとすることが最も少ないとも述べています。
- 公式が自ら挙げた後退:追跡・監視系など一部のマルチターン会話テストで後退が見られました。思考内容は多くの以前のモデルより読み取りにくくなっています。コンピューター操作環境での有害なタスクの拒否率はOpus 5.5と同等ですが、一部のより古いモデルには劣ります。
- しきい値:システムカードによると、RSP(Responsible Scaling Policy、責任あるスケーリング方針)の新しいしきい値はどれも超えていません。
小企鵝のまとめ
直接メリットを受けるのは3種類の人です。APIでSonnet 5を使っている人は、同じ価格でより速く、tokenを節約できる新版を手に入れられます。速さを求めるClaude Codeユーザーは、Claude Code 2.1.284でAnthropic APIのデフォルトのSonnetがSonnet 5.5に変わりました。スライドや文書をよく作る人は、公式が特に強調している分野です。
長時間の判断が必要で、方向性が明確でない仕事は、引き続きOpus 5.5に任せましょう。開発者はアップグレード前にeffortレベルを再テストし、上に挙げた破壊的変更にも注意してください。無料版でどのSonnetバージョンが動くかは、料金ページに書かれていません。確認したい場合は、アプリのモデルメニューを直接見てください。
関連記事
参考資料
カバー画像出典:Anthropic(anthropic.com/claude-sonnet-5-5)
- Anthropic公式発表:https://www.anthropic.com/claude-sonnet-5-5
- Claude Sonnet 5.5 System Card:https://www.anthropic.com/claude-sonnet-5-5-system-card
- Model overview:https://platform.claude.com/docs/en/models/sonnet-5-5/overview
- What’s new in Sonnet 5.5:https://platform.claude.com/docs/en/models/sonnet-5-5/whats-new-sonnet-5-5
- Migration guide:https://platform.claude.com/docs/en/models/sonnet-5-5/migration-guide
- API pricing:https://platform.claude.com/docs/en/about-claude/pricing
- Plans pricing:https://claude.com/pricing
- Claude Code CHANGELOG:https://github.com/anthropics/claude-code/blob/main/CHANGELOG.md
- GitHub Changelog:https://github.blog/changelog/2026-09-28-claude-sonnet-5-5-in-github-copilot/
- Artificial Analysis:https://artificialanalysis.ai/articles/claude-sonnet-5-5
- Vals.ai Index:https://www.vals.ai/benchmarks/vals_index
この記事は、AIモデルのAPI料金とサブスクリプションプランに関する消費者向け情報であり、証券や投資の助言ではありません。実際の料金はAnthropic公式の最新発表を確認してください。この記事の情報は2026年9月29日時点のもので、古くなっている可能性があります。