本文へ移動
技術を、自社の仕事に。
判断と実行を助けるメディア

記事を検索

Claude Sonnet 5.5に切り替える前に確かめること

目次 · 7項目

社内のAIアプリや業務システムにClaude APIを組み込み、既定のモデルを claude-sonnet-5 にしている。そこへ同じ単価のSonnet 5.5が出て、「IDを書き換えるだけで速く安くなるなら、すぐ替えたい」と言われる。一方で、Opus 5.5を使っている処理のうち、どれをSonnet 5.5に下げてよいのかも決めかねている。

Sonnet 5.5は単価こそ据え置きですが、Sonnet 5向けに書いたリクエストのうち、いくつかの設定はそのまま送ると400エラーになります。エラーにならずに画面の表示だけが変わる変更もあります。公式ドキュメントで確認できた範囲で、切り替え前に見る項目を整理します。

単価はSonnet 5と同じ、IDは日付なしの claude-sonnet-5-5

Sonnet 5.5の公開日は2026年9月28日で、Claude 5.5ファミリーの2番目のモデルです。Anthropicはこれを「Opus 5.5を補う、より速く低コストなモデル」と位置づけています。モデルの一覧ページに並ぶ現行モデルのうち、Sonnet 5.5とその上下を並べると次のとおりです。

項目Sonnet 5.5Opus 5.5Haiku 4.5
Claude APIのIDclaude-sonnet-5-5claude-opus-5-5claude-haiku-4-5-20251001
入力/出力(100万トークンあたり)$2 / $10$4 / $20$1 / $5
キャッシュ読み出し$0.20$0.20$0.10
コンテキスト長/最大出力100万 / 12.8万100万 / 12.8万20万 / 6.4万
思考(thinking)適応型(既定でオン)適応型(常にオン)拡張思考
APIでの既定のefforthighmedium非対応
廃止の目安2027年9月28日以降2027年9月22日以降2026年10月15日以降

Sonnet 5.5の料金は、プロンプトキャッシュとバッチ処理の料金を含めてSonnet 5と同じです(5分間のキャッシュ書き込み$2.50、1時間のキャッシュ書き込み$4、Batch APIは入力・出力とも50%引き)。トークナイザーもSonnet 5と同じで、同じ文章なら同じトークン数になります。

Anthropicの紹介ページは、Sonnet 5より出力が30%以上速く、同社の試験では1タスクあたりの費用が最大30%少ない(使うトークンが減るため)としています。自社の処理で同じ割合になるとは限りません。

提供先は、Claude API、Amazon Bedrock(IDは anthropic.claude-sonnet-5-5)、Claude Platform on AWS、Google Cloud、Microsoft Foundryです。Amazon Bedrock以外では、どの提供先でもIDは claude-sonnet-5-5 です。

Sonnet 5のコードが400エラーになりうる5か所

公式の「What’s new in Claude Sonnet 5.5」は、Sonnet 5で動いているコードに影響する破壊的変更を5つ挙げています。

Sonnet 5で送っていた設定Sonnet 5.5での扱い置き換え先
thinking: {"type": "disabled"}400エラー{"type": "between_tools"}(effortはhigh以下)
tool_choice の any / tool400エラー(トークン数の計測でも同じ)auto + strict tool use、プロンプトで呼ぶ場面を指示
途中の履歴を編集して思考ブロックを再送条件によって400エラー会話を追記のみにする
computer_20251124 (Claude API, Google Cloud)400エラーcomputer_toolset_20260801
advisorにOpus 4.8・Opus 4.7・Sonnet 5400エラーSonnet 5.5が受け付けるadvisor

1行目は、紹介ページの「始め方」でも名指しされている変更です。Sonnet 5.5では、何も指定しなくても適応型の思考が動きます。思考を止めていた処理は、最も低い設定の between_tools に書き換えます。xhighとmaxのeffortとは併用できません。ツールを使わないリクエストなら、応答はテキストだけになります。

# Sonnet 5
client.messages.create(model="claude-sonnet-5", thinking={"type": "disabled"}, ...)
# Sonnet 5.5
client.messages.create(model="claude-sonnet-5-5", thinking={"type": "between_tools"},
                       output_config={"effort": "high"}, ...)

2行目は、分類や項目の抽出で特定のツールを必ず呼ばせている処理が該当します。auto ではツールを呼ばずに答える場合があるため、呼ぶ場面をプロンプトで指示します。Amazon BedrockではSonnet 5.5で構造化出力(strict tool useを含む)が使えないため、ツールへの入力をコード側で検証するよう案内されています。

3行目は、2026年8月31日(UTC)以降に作られたアカウントで、Claude API・Amazon Bedrock・Google Cloudに既定で効くチェックです。システムプロンプト、ツール、前のメッセージを書き換えてからSonnet 5.5の思考ブロックを送り直すとエラーになります。指示を変えるときは、会話の途中に挟むsystemメッセージを使います。

もう1つ、エラーは出ないのに応答の形が変わる点があります。ツール呼び出しの合間に書く1〜2文より長いメモが、既定では中身が空の思考ブロックで返ります。途中経過を利用者に流している画面は、エラーなしで無言になります。between_tools を使うか、thinking.display を指定すると戻ります。

エラーにならずに変わる挙動

コードを直さなくても、次の違いは出ます。

  • effortの目盛りが変わった。 同じ high でもSonnet 5と同じ量の思考にはならず、公式は測り直すよう求めています。目安は、通常はhigh、手順がはっきりしたエージェント型の処理はmedium、待ち時間を気にするチャットはmediumかlowからです。
  • 断られる種類が増えた。 拒否は stop_reason: "refusal" で返り、stop_details にcyber、bio、frontier_llm、reasoning_extraction、general_harmsの5分類のどれかが入ります。Claude APIのサーバー側のフォールバック(ベータ)は、cyberとfrontier_llmの拒否だけをSonnet 5で再試行します。
  • キャッシュの最小長が短くなった。 キャッシュできるプロンプトの最小長が、Sonnet 5の1,024トークンから512トークンになりました。
  • 思考ブロックは作ったアカウントでしか使えない。 別のアカウントから送ると、ブロックは落とされ、リクエストは成功します。

Sonnet 4.6以前から移る場合は、さらに変更が増えます。temperature・top_p・top_k に既定以外の値を入れると400エラーになり、思考の予算指定(budget_tokens)も使えません。同じ文章でも、Sonnet 4.6・Sonnet 4.5・Haiku 4.5より約30%多いトークンになります。

Opus 5.5から下げる処理、Haiku 4.5から上げる処理

Opus 5.5の料金と費用の見直し方は、安い新モデルが出ても、請求額は自動では下がらないで扱いました。ここでは、Sonnet 5.5をどこに置くかを見ます。

公式の「Choosing a model」は、Opus 5.5を複雑なエージェント型のコーディングや企業の作業向け、Sonnet 5.5を日常的なコーディングや業務の処理で速さと能力を両立させたいとき向けとしています。紹介ページには、Sonnet 5.5・Sonnet 5・Opus 5.5の順に、Terminal-Bench 4.0で70.6%・10.3%・66.4%(Opus 5.5はxhighのeffortでの値)、CursorBench 4.0で55.5%・34.1%・57.8%という数字が並びます。同じページは、判断が長く続く複雑な作業ではOpus 5.5がはっきり強いとも書いており、数字の近さだけで下げる処理は決められません。

Opus 5.5からSonnet 5.5へ振り分ける場合、次の点が変わります。

  • Sonnet 5.5は、Opus 5・Opus 5.5・Fable・Mythosの思考ブロックを読みません。会話の途中でOpus 5.5から切り替えると、以降の応答はその思考を引き継ぎません(リクエストは成功し、落とされたブロックは課金されません)。
  • 高速モード(リサーチプレビュー)の対象はOpus 5.5・Opus 5・Opus 4.8で、Sonnet 5.5にはありません。
  • Opus 5.5は思考を止められませんが、Sonnet 5.5は between_tools で事前の思考を止められます。

Haiku 4.5から上げる場合は、単価が上がるうえに同じ文章のトークン数も増えるため、移行ガイドは費用の測り直しを求めています。紹介ページは、量の多い処理向けのClaude Haiku 5.5が数週間のうちに加わる予定だとしています。量で効く処理をHaiku 4.5で回しているなら、Sonnet 5.5へ上げるかどうかはHaiku 5.5の公開を待って比べる、というのが編集部の見方です。処理ごとのモデルの充て方は、開発でどのモデルに任せるかの決め方でも整理しています。

Sonnet 5の期限は、少なくとも2027年6月30日まで

「Model deprecations」のページで、claude-sonnet-5 は現役(Active)で、廃止は2027年6月30日より前にはならないとされています。公開モデルの廃止は、利用中の顧客に少なくとも60日前に通知されます。

期限が近いのは、むしろ古い世代です。claude-sonnet-4-5-20250929 は2026年9月29日以降、claude-haiku-4-5-20251001 は2026年10月15日以降が廃止の目安です。いずれもまだ廃止予定(Deprecated)にはなっていません。目安の日付は「これより前には廃止しない」という意味で、実際の廃止日は告知で決まります。これらの日付はClaude API、Claude Platform on AWS、Microsoft Foundryのもので、Amazon BedrockとGoogle Cloudは独自に期限を決めます。どのキーでどのモデルが使われているかは、Claude ConsoleのUsageページからエクスポートするCSVで確認できます。

切り替えの手順

Sonnet 5.5へ切り替える前に確認する5つの項目(モデルIDと単価、400エラーになりうる設定、書き換え前後のリクエスト、effortの測り直し、旧モデルの期限)と、それぞれを確認する公式ページの対応を示した編集部の図

図は、確認する項目と、確かめる公式ページの対応です。ここからは公式の記述を踏まえた編集部の提案です。

  1. コードから該当する設定を探す。 "disabled"、tool_choice、temperature・top_p・top_k、computer_20251124、advisorの指定、履歴を書き換えて送り直す処理を検索し、上の表と突き合わせます。移行ガイドは、Claude Codeの /claude-api migrate で書き換えと確認項目の一覧づくりを任せる方法も案内しています。
  2. effortを2〜3段階で比べる。 Sonnet 5で使っていた値をそのまま使わず、本番と同じ種類の入力で品質と1件あたりの費用を測ります。
  3. 途中経過を表示する画面を確かめる。 ツール呼び出しの合間に何も表示されなくなっていないかを、実際の画面で見ます。
  4. 拒否されたときの処理を確かめる。 stop_reason: "refusal" を受けたときに、エラー扱いで止まるのか、別のモデルで再試行するのかを決めておきます。
  5. モデルIDを設定値にして、処理ごとに切り替える。 全処理を一度に替えず、1つずつ替えて、Sonnet 5に戻せる状態を残します。

モデル名がコードの複数箇所に散らばっていると、手順5がそのまま改修作業になります。窓口を1か所にまとめる考え方は、社内AIにゲートウェイを1枚挟むかで扱いました。

2026年9月30日に、Claudeのリリースノート(2026年9月28日の項)、Claude APIのリリースノート、Claude Platform Docsのモデル一覧、Sonnet 5.5のモデルページ・What’s new・移行ガイド・プロンプトのガイド、料金、Model deprecations、Choosing a model、AnthropicのSonnet 5.5紹介ページを直接開いて照合しました。APIキーがないため、Sonnet 5.5へのリクエストは送っておらず、エラーの内容、速度、トークン数、1件あたりの費用、Amazon Bedrock・Google Cloud・Microsoft Foundryでの挙動は検証していません。ベンチマークの数値はAnthropicの公表値です。

Claude APIを組み込んだ社内システムのモデル切り替えや、モデルを差し替えやすい構成への見直しは、グリームハブへご相談ください。

Sources

この記事を共有XFacebook
鈴木 翔

技術の可能性に魅了され、学生時代からプログラミングとデジタルアートの分野に深い関心を持つ

この記事のテーマを、自社の次の一歩へ

AIを任せる仕事から、一緒に考える。

いまの業務と使うデータを整理し、AIに任せる範囲、人が確認すること、試し方を考えます。

  • 対象にする業務
  • 利用するデータ
  • 効果の確かめ方
業務でのAI活用を相談する

構想段階からご相談いただけます。この記事の情報を相談フォームに引き継ぎます。

最新記事をメールで受け取る