結論:使い方ごとに、こうなります
Anthropic は 2026年9月28日に Claude Sonnet 5.5 を出しました(出典: https://www.anthropic.com/claude-sonnet-5-5)。Sonnet 5 から乗り換えたときの結果は、使い方で分かれます。
| どんな使い方か | やること | どうなるか |
|---|---|---|
| Claude のアプリでチャットしている | Sonnet 5.5 を選んで使う | 出力が30%以上速くなる。単価も使い勝手も変わらない |
| API で Sonnet 5 を使っている(特別な設定なし) | モデル名を claude-sonnet-5-5 に替える |
単価は1トークンあたり同額。使うトークン数が減り、1つの仕事の費用は最大30%減 |
| API で「考える」を切る・道具を強制する・旧computer useを使っている | 先に設定を直してから替える | 直さずに替えると、400エラーで止まる |
一言でいうと、値段は変わらず出力は3割速くなった。ただし4つの設定は、そのままでは動かない。
先に断っておきます。この記事は運営者が Sonnet 5.5 を試した記録ではありません。公式ページに書かれていることを読んで、使い方ごとに整理したものです。
ここから下は、表の3行がなぜそうなるのかの説明です。
なぜそうなるのか
費用が最大30%下がる理由
Anthropic は発表ページで、単価は変えていないと明記しています(出典: https://www.anthropic.com/claude-sonnet-5-5)。
| 100万トークンあたり | Claude Sonnet 5 | Claude Sonnet 5.5 |
|---|---|---|
| 入力 | $2 | $2 |
| 出力 | $10 | $10 |
| 読み直し(キャッシュ読み取り) | $0.20 | $0.20 |
| キャッシュ書き込み(5分保持) | $2.50 | $2.50 |
| キャッシュ書き込み(1時間保持) | $4 | $4 |
出典: https://platform.claude.com/docs/en/models/sonnet-5-5/overview と https://platform.claude.com/docs/en/models/sonnet-5/overview
単価そのものは1円も変わっていません。それでも費用が下がるのは、Sonnet 5.5 が同じ仕事をより少ないトークンで終えるからだと公式は説明しています(出典: 同上)。公式のテストでは、1つの仕事あたりの費用が最大30%少なくなりました。
30%はAnthropic自身のテストの値です。自分の使い方で同じだけ下がるとは限りません。単価が変わっていないことだけは、どの使い方でも確かです。
出力が30%以上速くなる理由
Sonnet 5.5は、Sonnet 5より出力を30%以上速く生成します(出典: 同上)。Anthropicが出した中で、いちばん速いSonnetモデルです。速さの中身(どのテストで測ったか)は公式ページに書かれていないため、この記事では倍率だけを書きます。
4つの設定が止まる理由
Sonnet 5.5では内部の仕様が変わり、Sonnet 5で動いていた設定のうち4つがエラーになります(出典: https://platform.claude.com/docs/en/models/sonnet-5-5/whats-new-sonnet-5-5)。
| 設定 | Sonnet 5 | Sonnet 5.5 |
|---|---|---|
「考える」を切る指定 disabled |
切れる | 400エラー(between_tools に置き換え) |
道具を強制する指定(any / tool) |
できる | 400エラー(auto と none だけ) |
旧パソコン操作の道具(computer_20251124) |
使える | Claude API と Google Cloud では400エラー(Amazon Bedrock では使える) |
| advisorツールの助言役に Opus 4.8 / Opus 4.7 / Sonnet 5 を指定 | できる | 400エラー |
モデル名だけ書き換えて乗り換えると、上の設定を使っている自動化はその場で止まります。
もう1つ、エラーにはならないものの気づきにくい変化があります。「考える」の途中経過を記録した内部データ(thinking block)は、使ったモデルと会話に紐づきます(出典: 同上)。Sonnet 5.5 は Sonnet 5・Opus 4.8・Haiku 4.5 以前の記録は読めますが、Opus 5・Opus 5.5・Fable系・Mythos系の記録は読めません。合わないデータはAPIが自動で取り除くため、通常はリクエストが失敗することはありません。
ただし例外があります。2026年8月31日0時(UTC)以降に作られたアカウントでは、この確認が既定で有効です。会話の前提(システムプロンプトや道具)が変わった後に、古い記録をそのまま送ると400エラーになります(出典: 同上)。
公式が示している直し方は、次の順番です(出典: 同上)。
- モデル名を
claude-sonnet-5からclaude-sonnet-5-5に変える - 「考える」を切る設定を
between_toolsに置き換える - 道具の強制指定は
autoに戻し、どの場面でその道具を使うかを指示文に書く - パソコン操作は、Claude API・Google Cloud では新しい道具(
computer_toolset_20260801)に移す
性能はどれだけ上がったか
発表ページの比較表から、Sonnet 5 と Sonnet 5.5 の列を抜き出しました。
| 何のテストか | 分野 | Sonnet 5 | Sonnet 5.5 |
|---|---|---|---|
| Terminal-Bench 4.0 | プログラム作成の自動化 | 10.3% | 70.6% |
| FrontierCode 1.1(Main・Max効果) | プログラム作成の自動化 | 42.4% | 46.2% |
| CursorBench 4.0 | プログラム作成の自動化 | 34.1% | 55.5% |
| GDPval-AA v2.1 | 事務の仕事 | 1449 | 1844 |
| AA-Briefcase v1.1 | 事務の仕事 | 1359 | 1811 |
| Humanity's Last Exam(道具あり) | 幅広い分野の推論 | 54.9% | 64.5% |
| OSWorld 2.1(部分点あり) | パソコン操作 | 57.0% | 80.1% |
| Chartography(道具なし) | グラフの読み取り | 15.6% | 61.6% |
出典: すべて https://www.anthropic.com/claude-sonnet-5-5
いちばん差が大きいのはTerminal-Bench 4.0で、10.3%から70.6%に上がりました。公式はこの項目について「Sonnet 5の最高点を、1タスクあたり10分の1未満の費用で超えた」と説明しています(出典: 同上)。
いくつかのテストでは、Sonnet 5.5(Max効果)はOpus 5.5と同程度の点数になると公式も書いています。ただし公式は続けて、「ベンチマークの点数はモデルの能力の一面しか捉えていない。継続的な判断力が要る複雑で自由度の高い作業では、Opus 5.5のほうが明らかに上」とも説明しています(出典: 同上)。
GDPval-AAとAA-Briefcaseは、外部の計測会社(Artificial Analysis)が Sonnet 5.5 の公開前の版で測った値です。公式の注記によると、当時は構造化出力の応答が劣化するバグがありました(現在は修正済み)。影響があるとすれば、点数を低く見せる方向だとしています(出典: 同上)。
Sonnet 5 と他社の比較は Claude Opus 5 の記事 に、Opus 5.5 の中身は Claude Opus 5.5 の記事 に書いています。
他社の上位モデルと比べると
単価
各社の公式料金ページから直接取った数字だけを並べます。
| モデル | 提供元 | 入力(100万トークン) | 出力(100万トークン) | 読み直し(キャッシュ読み取り) | キャッシュ書き込み |
|---|---|---|---|---|---|
| Claude Sonnet 5.5 | Anthropic | $2 | $10 | $0.20 | $2.50(5分)/ $4(1時間) |
| Claude Sonnet 5 | Anthropic | $2 | $10 | $0.20 | $2.50(5分)/ $4(1時間) |
| Claude Opus 5.5 | Anthropic | $4 | $20 | $0.20 | $5(5分) |
| GPT-6 Astra | OpenAI | $10.00 | $50.00 | $1.00 | $12.50 |
| GPT-6 Sol | OpenAI | $2.00 | $10.00 | $0.20 | $2.50 |
| Gemini 3.1 Pro Preview | $2.00(20万トークン以下)/ $4.00(超過時) | $12.00(20万トークン以下)/ $18.00(超過時) | $0.20(20万トークン以下)/ $0.40(超過時) | 公表されていない |
出典: Claude は https://platform.claude.com/docs/en/models/sonnet-5-5/overview・https://platform.claude.com/docs/en/models/sonnet-5/overview・https://platform.claude.com/docs/en/about-claude/pricing、OpenAI は https://developers.openai.com/api/docs/pricing、Google は https://ai.google.dev/gemini-api/docs/pricing
Claude Sonnet 5.5 と OpenAI の GPT-6 Sol は、単価が4項目とも一致しています(両社の公式料金ページで確認)。
- 入力: どちらも$2
- 出力: どちらも$10
- 読み直し(キャッシュ読み取り): どちらも$0.20
- キャッシュ書き込み(5分保持): どちらも$2.50
Anthropicにはこのほかに「1時間保持」のキャッシュ書き込み枠($4)があります。OpenAIの料金表には、対応する行がありません。
GPT-6 AstraはSonnet 5.5の5倍の単価です。AstraはOpenAIの最上位モデルです。Sonnet 5.5と同じ「中位〜上位」の帯にいるのは、GPT-6 Solのほうです。
単価が同じでも、会社ごとにトークンの数え方が違うため、支払う金額が同じとは限りません。
仕様
| モデル | 一度に読める量 | 一度に書ける量 | 学習データの締め切り |
|---|---|---|---|
| Claude Sonnet 5.5 | 100万トークン | 12.8万トークン | 2026年6月 |
| Claude Sonnet 5 | 100万トークン | 12.8万トークン | 2026年1月 |
| GPT-6 Astra | 1,050,000トークン | 128,000トークン | 2026年4月30日 |
| GPT-6 Sol | 1,050,000トークン | 128,000トークン | 2026年4月20日 |
| Gemini 3.1 Pro Preview | 1,048,576トークン | 65,536トークン | 公表されていない |
出典: Claude は各モデルページ(前掲)、OpenAI は https://developers.openai.com/api/docs/models/gpt-6-astra と https://developers.openai.com/api/docs/models/gpt-6-sol、Google は https://ai.google.dev/gemini-api/docs/models/gemini-3.1-pro-preview
一度に書ける量は4モデルとも同じです。Sonnet 5.5・Sonnet 5・GPT-6 Astra・GPT-6 Solは、いずれも12.8万(128,000)トークンです。一度に読める量も、Claudeの2モデルは100万、OpenAIの2モデルは105万トークンとほぼ同じ規模です。学習データの締め切りは、Sonnet 5.5(2026年6月)がこの3社5モデルの中でいちばん新しくなりました。OpenAIの2モデルは4月、Sonnet 5は1月です。Geminiは締め切りが公式ページに書かれていません。
性能テスト(Anthropicの表に載っている範囲)
発表ページの比較表には GPT-6 Sol の列もあります。
| 何のテストか | Sonnet 5.5 | GPT-6 Sol |
|---|---|---|
| FrontierCode 1.1(Main) | 46.2% | 49.3% |
| GDPval-AA v2.1 | 1844 | 1487 |
| AA-Briefcase v1.1 | 1811 | 1483 |
| Chartography(道具なし) | 61.6% | 53.6% |
出典: すべて https://www.anthropic.com/claude-sonnet-5-5(Terminal-Bench・CursorBench・Humanity's Last Exam・OSWorldの列にGPT-6 Solの値は載っていません)
FrontierCodeだけはGPT-6 Solのほうが高い点です。それ以外の3項目はSonnet 5.5が上回っています。ただし前述のとおり、GDPval-AAとAA-Briefcaseは公開前の版で測られた値です。
ここに並ぶのは、測る側も条件もばらばらの数字です。公式の数字で言い切れるのは単価の並びまでで、「どれが賢いか」ではありません。
この記事で分からないこと
- 実際に使ったときの体感
- 日本語での文章の品質
- 出力速度「30%以上」の具体的な測り方
- Claude Haiku 5.5 の中身
どれも公式ページに数字がなく、運営者も試していないので書けません。
出典一覧
すべて各社の公式ページです。まとめ記事・ニュースサイト・個人ブログは1件も使っていません。
- Claude Sonnet 5.5 の発表(Anthropic・2026年9月28日): https://www.anthropic.com/claude-sonnet-5-5
- Claude Sonnet 5.5 のモデルのページ(Anthropic 公式ドキュメント): https://platform.claude.com/docs/en/models/sonnet-5-5/overview
- What's new in Claude Sonnet 5.5(Anthropic 公式ドキュメント): https://platform.claude.com/docs/en/models/sonnet-5-5/whats-new-sonnet-5-5
- Claude Sonnet 5 のモデルのページ(Anthropic 公式ドキュメント): https://platform.claude.com/docs/en/models/sonnet-5/overview
- 料金(Anthropic 公式ドキュメント): https://platform.claude.com/docs/en/about-claude/pricing
- API の料金(OpenAI 公式ドキュメント): https://developers.openai.com/api/docs/pricing
- GPT-6 Astra のモデルページ(OpenAI 公式ドキュメント): https://developers.openai.com/api/docs/models/gpt-6-astra
- GPT-6 Sol のモデルページ(OpenAI 公式ドキュメント): https://developers.openai.com/api/docs/models/gpt-6-sol
- Gemini API の料金(Google 公式): https://ai.google.dev/gemini-api/docs/pricing
- Gemini 3.1 Pro Preview のモデルページ(Google 公式): https://ai.google.dev/gemini-api/docs/models/gemini-3.1-pro-preview
料金と仕様は変わります。実際に支払う前に、必ず上記の公式ページで現在の値を確認してください。