>
>
公開日
Anthropicは2026年9月28日(米国時間)、Claude 5.5ファミリーの2番目のモデル「Claude Sonnet 5.5」を公開しました。API料金はSonnet 5と同じまま、出力速度は30%以上速くなり、同じ作業に必要なトークン数が減ったことで、タスクあたりのコストは最大30%下がったとされています。
情シスにとっての論点は、「Opus 5.5とどう使い分けるか」「既存の社内ツールをそのまま移行できるか」「セキュリティ系の依頼が別モデルに切り替わる仕組みをどう扱うか」の3つです。本記事では、Anthropicの公式発表、開発者向けドキュメント、ヘルプセンターの情報をもとに、この3点を中心に整理します。
本記事のポイント
Sonnet 5.5は、範囲が明確な日常業務、バグ修正、文書・スライド・表計算の作成に強い「速くて安い」モデルで、Opus 5.5を補完する位置づけ
単価はSonnet 5と同じ(入力$2・出力$10/100万トークン)。コスト削減は値下げではなく、消費トークンの削減によるもの
思考(thinking)の無効化方法の変更や強制ツール使用の廃止など、Sonnet 5からの移行には5つの破壊的変更がある
Sonnetとして初めてサイバー分野のセーフガードを搭載し、リスクの高い依頼はSonnet 5へ自動で切り替わる。アプリでは既定で有効、APIでは開発者が設定する
判断の持続が必要な複雑な作業ではOpus 5.5が優位と、Anthropic自身が明言している
Claude Sonnet 5.5とは|Sonnet 5から何が変わったか
Sonnet 5.5は、Sonnet 5の後継となる中位モデルです。性能を大きく伸ばしながら料金は据え置かれ、「同じ予算でより多くの業務を回せるモデル」に変わった点が最大の変化です。
Claudeのモデル体系は、上から順にFable、Opus、Sonnet、Haikuと並び、Sonnetは性能と速度・料金のバランスを取った中位モデルです(各モデルとプランの全体像はClaudeとは?読み方・料金と企業活用で解説しています)。Anthropicは、慎重な判断を要する複雑な作業はOpus 5.5、範囲が明確な日常業務やバグ修正、完成度の高い文書・スライド・スプレッドシートの作成はSonnet 5.5、という役割分担を示しています。大量処理やコスト重視の用途向けには「Claude Haiku 5.5」を今後数週間以内に追加する予定です。
公式ドキュメントに掲載された主な仕様を、周辺モデルと並べると次のとおりです。
項目 | Claude Sonnet 5.5 | Claude Opus 5.5 | Claude Fable 5.1 | Claude Haiku 4.5 |
|---|---|---|---|---|
料金(入力/出力、100万トークンあたり) | $2 / $10 | $4 / $20 | $10 / $50 | $1 / $5 |
コンテキストウィンドウ | 100万トークン | 100万トークン | 100万トークン | 20万トークン |
最大出力 | 12.8万トークン | 12.8万トークン | 12.8万トークン | 6.4万トークン |
応答速度の目安 | 速い | 中程度 | 遅め | 最速 |
思考(thinking) | 適応型(Adaptive) | 適応型(常時オン) | 適応型(常時オン) | 拡張(Extended) |
既定のeffort(API) | high | medium | high | ― |
知識のカットオフ | 2026年6月 | 2026年6月 | 2026年6月 | 2025年2月 |
提供先はClaudeの各アプリとClaude APIに加え、Amazon Bedrock、Google Cloud、Microsoft Foundry、Claude Platform on AWSです。APIのモデルIDは claude-sonnet-5-5(Amazon Bedrockのみ anthropic.claude-sonnet-5-5)で、廃止時期は「2027年9月28日より前にはならない」とされています。Opus 5.5やSonnet 5と同様に、ゼロデータ保持(入出力をAnthropic側に保存しない契約形態)にも対応しています。
なお、トークナイザー(文章をトークンに分割する仕組み)はSonnet 5と同じため、同じ文章から数えられるトークン数は変わりません。Sonnet 5の登場時に話題になった料金面の注意点は、Claude Sonnet 5の移行ガイドで整理しています。上位モデルの仕様や移行時の論点は、Claude Opus 5.5の解説記事とあわせて読むと、5.5ファミリー全体の違いがつかみやすくなります。
性能の読み方|「Opus並み」のスコアと、Opusに任せるべき業務の線引き
多くの評価でSonnet 5.5はOpus 5.5に迫り、一部では上回りました。ただしAnthropicは、判断を持続的に求められる複雑で自由度の高い作業では、引き続きOpus 5.5のほうが明らかに優れていると説明しています。スコアだけで「Opusはもう不要」と判断しないことが大切です。Opus 5.5がどのような長時間作業で強みを発揮するのかは、Claude Opus 5.5の解説記事で早期テスターの事例とあわせて紹介しています。
主要ベンチマークの比較
公式発表で示された主な数値です(GPT-6 Solの値は他社の公表値の引用)。
評価内容 | ベンチマーク | Sonnet 5.5 | Sonnet 5 | Opus 5.5 | GPT-6 Sol |
|---|---|---|---|---|---|
コマンドライン上の複数段階の作業 | Terminal-Bench 4.0 | 70.6% | 10.3% | 66.4%(xhigh) | ― |
マージされるコード変更 | FrontierCode 1.1 | 46.2%(max)/52.1%(xhigh) | 42.4% | 54.4% | 49.3% |
実際の開発に近い複数ファイルの作業 | CursorBench 4.0 | 55.5% | 34.1% | 57.8% | ― |
44職種の実務 | GDPval-AA v2.1(Elo) | 1844 | 1449 | 1846 | 1487 |
長時間の知識労働 | AA-Briefcase v1.1(Elo) | 1811 | 1359 | 1822 | 1483 |
コンピューター操作 | OSWorld 2.1 | 80.1% | 57.0% | 81.8% | ― |
図表の読み取り | Chartography | 61.6% | 15.6% | 64.4% | 53.6% |
※Eloは複数モデルの成果物を比べて算出する相対評価で、正答率ではありません。
数値を読むときは、次の3点を押さえておくと判断を誤りにくくなります。
1つ目は、「考えさせるほど点が上がる」とは限らない点です。FrontierCodeでは、最も深い設定(max)の46.2%より、一段低い設定(xhigh)の52.1%のほうが高得点でした。Anthropicは、maxでは依頼範囲を超えた変更が増えて減点されたと注記しています。
2つ目は、測定条件がすべてのモデルでそろっているわけではない点です。GPT-6 Solの値は他社の公表値で、GDPval-AAとAA-Briefcaseは正式公開前の環境で測定されています(構造化出力の不具合があったが、影響は小さいとの注記あり)。
3つ目は、Anthropic自身が「ベンチマークは能力の一面しか捉えていない」と述べている点です。Terminal-Bench 4.0でOpus 5.5を上回っていても、長時間の判断を要する業務でSonnet 5.5が同等に動くとは限りません。
情シスが見るべきは「低い設定でどこまで足りるか」
Sonnet 5.5の真価は、低いeffort(思考の深さの設定)でも前世代を大きく上回る点にあります。複数の評価で、lowやmediumのSonnet 5.5が、Sonnet 5の最高スコアを約10分の1のコストで上回ったとされています。
早期テスターの報告も、業務システムでの効率改善を示すものが目立ちます。
企業 | 報告された結果 |
|---|---|
Zendesk | 数百件の実際のサポート事例で判断ミスが減り、チケット処理が20%速くなった |
Box | 元資料のデータを再確認して前モデルが見逃した誤りを検出。精度が上がり、2.4倍速く、総トークンは12%減 |
Slack | プロンプトを変えずに社内評価のほぼすべてでSonnet 5を上回り、出力トークンは約14%減 |
Atlassian | Rovoのエージェントを、Sonnet 5より最大30%速く実行できる見込み |
CodeRabbit | 単純〜中程度のコードレビューを先行して移行する方針 |
社内ヘルプデスク、文書処理、コードレビューのように「件数が多く、1件ごとの判断の範囲が決まっている」業務は、Sonnet 5.5に向いていると考えられます。
料金とコスト|単価は据え置き、消費トークン減で実効コストは最大3割減
API単価はSonnet 5とまったく同じです。コストが下がるのは、同じ作業を終えるまでに使うトークンが減るためで、Anthropicのテストではタスクあたり最大30%安くなりました。
API料金(100万トークンあたり)
項目 | Sonnet 5.5 | Sonnet 5 | Opus 5.5 |
|---|---|---|---|
入力 | $2 | $2 | $4 |
出力 | $10 | $10 | $20 |
キャッシュ書き込み(5分) | $2.50 | $2.50 | $5 |
キャッシュ書き込み(1時間) | $4 | $4 | $8 |
キャッシュ読み出し | $0.20 | $0.20 | $0.20 |
バッチ処理 | 入出力とも50%割引 | 入出力とも50%割引 | 入出力とも50%割引 |
キャッシュ(同じ文脈を再利用する仕組み)の最小サイズは512トークンに下がり、Sonnet 5の1,024トークンより短いプロンプトでも使えるようになりました。バッチ処理では、ベータ版のヘッダーを付けると最大30万トークンまで出力できます。
「Opusの半額」とは限らない点に注意
入力・出力の単価はOpus 5.5のちょうど半分ですが、キャッシュ読み出しは両モデルとも$0.20です。そのため、同じ資料を何度も読み込む使い方では、両モデルの差は2倍より小さくなります。
公式単価で試算すると、次のようになります(入力合計100万トークン・出力1万トークン、キャッシュ書き込みの費用は含めない)。
入力のうちキャッシュから読む割合 | Sonnet 5.5 | Opus 5.5 | 差 |
|---|---|---|---|
0% | $2.10 | $4.20 | 2.0倍 |
90% | $0.48 | $0.78 | 約1.6倍 |
Claude Codeのように同じ文脈を何度も読み込む使い方が中心なら、「安いからSonnet」と決め打ちせず、実際の業務で両モデルの請求額と品質を比べて判断するほうが確実です。
アプリとAPIでeffortの既定値が違う
effortの既定値は、Claude CodeとClaudeアプリではmedium、Claude Platform(API)ではhighです。同じSonnet 5.5でも、利用する場所によって初期設定の考える深さが異なります。
あわせて、effortの各レベルはSonnet 5と同じ量の思考を生まないよう再調整されています。公式の移行ガイドは、Sonnet 5の設定を引き継がず、比較検証をやり直すよう求めています。目安は次のとおりです。
仕様が明確なエージェント型コーディングや複数ステップのツール利用:mediumから始め、難しい・長い作業はhighへ
チャットなど応答速度を重視する用途:mediumまたはlowから
それ以外:highから
予算見直しの進め方
「最大30%安くなる」はAnthropicのテスト結果で、自社の請求額が同じだけ下がるとは限りません。次の順で進めると、根拠のある数字を経営層に出しやすくなります。
直近1〜3か月のSonnet 5の利用量を、入力・出力・キャッシュ読み出しに分けて把握する
代表的な業務をSonnet 5.5のlow・medium・highで数件ずつ試し、1タスクあたりのトークン消費と品質を比べる
Opus 5.5で処理している業務のうち、Sonnet 5.5に移しても品質を保てるものを洗い出す
部門ごとの利用量を見て、既定モデルとeffortの設定を決める
複数のAIベンダーを併用している場合は、比較の軸を単価だけに置かないことも大切です。通常のAPI単価はGPT-6 Solと同じ水準のため、両者の差は1タスクあたりの消費トークンと、管理機能の違いに表れます。OpenAI側の管理設定はGPT-6 Sol・Luna公開|情シスが確認すべき管理設定で解説しています。
部門ごとに契約や請求がばらばらだと、そもそも利用量の把握から手間がかかります。Adminaのコスト管理機能でSaaSやAIサービスの支払いを一覧にしておくと、モデル切り替えの前後で費用がどう変わったかを追いやすくなります。
API移行の破壊的変更|5つの確認点と「エラーにならない変化」
モデルIDを書き換えるだけでは移行は終わりません。Sonnet 5で動いているコードには5つの破壊的変更が影響し、さらにエラーを出さずに挙動だけが変わる変更もあります。
5つの破壊的変更
変更内容 | 起きること | 対応 |
|---|---|---|
思考の無効化方法が変わった |
|
|
強制ツール使用に非対応 |
|
|
思考ブロックがモデル・会話・アカウントに紐づく | Sonnet 5.5から別モデルへ切り替えると、以前の推論は引き継がれない。2026年8月31日以降に作成したアカウントでは、過去の文脈を編集して再送すると400エラーになる | 会話は追記のみで進め、指示の変更は会話途中のシステムメッセージで行う |
旧コンピューター操作ツールに非対応 | Claude APIとGoogle Cloudで |
|
advisorツールの組み合わせ制限 | Opus 4.8、Opus 4.7、Sonnet 5をアドバイザーにすると400エラーになる | Opus 5以降、Fable、Mythos、Sonnet 5.5自身のいずれかに切り替える |
このほか、temperature、top_p、top_k を既定以外の値にすると400エラーになります。生成結果のばらつきをこれらの値で制御していた社内ツールは、見直しが必要です。
3つ目の変更は、蒸留(大量のアカウントでモデルの出力を集め、能力を別モデルに写し取る行為)への対策です。Sonnet 5.5が生成した思考は、作成したアカウント(またはリンクされたアカウント)でしか機能しません。Claude Codeのセッション途中でアカウントを切り替えるような使い方をしている場合は、影響を受ける可能性があります。
エラーにならないが挙動が変わる点
見落としやすいのは、リクエストは成功するのに結果が変わるケースです。
ツール呼び出しの合間のテキストが「思考ブロック」で返る:これまで進捗表示として画面に流していた文章が、既定設定では空になります。社内チャットボットで「処理中の表示が出なくなった」という問い合わせが来たら、まずこの変更を疑ってください。
effortの効き方が変わる:同じhighでも、Sonnet 5と同じ量の思考にはなりません。品質や速度が想定と違うと感じたら、effortの再検証が先です。
拒否は「成功(HTTP 200)」で返る:セーフガードで拒否されたリクエストはエラーにならず、
stop_reason: "refusal"として返ります。HTTPステータスだけで監視していると、拒否の発生に気づけません。
開発部門に移行を依頼する際は、上の表とこの3点をそのままチェック項目として渡すと、抜け漏れを防げます。Amazon Bedrock経由で使っている場合は、旧コンピューター操作ツールの扱いがClaude APIと異なるなど経路ごとの差があるため、Amazon Bedrockの料金体系とモデル選定もあわせて確認しておくと安心です。
また、移行作業そのものをClaude Codeで進める開発者も多いはずです。その場合は、どのAPIキーで、どの権限のもとで作業させるかを先に決めておきます。考え方はClaude Code 企業利用の統制ガイドで解説した権限設計の原則がそのまま使えます。
セーフガードと自動切り替え|リスクの高い依頼はSonnet 5へ回される
Sonnet 5.5は、Sonnetとして初めて、最上位モデル向けと同様のサイバー分野のセーフガードを搭載しました。サイバーセキュリティの能力がOpus 5に匹敵すると評価されたためです。通常の開発業務にはほぼ影響しませんが、セキュリティ業務でClaudeを使う組織は、動作の違いを事前に確かめておく必要があります。
4分野のセーフガードの中身
ヘルプセンターの説明によると、判定の結果は分野ごとに次のように分かれます。
分野 | 判定された場合 | 主な対象 |
|---|---|---|
サイバーセキュリティ | Sonnet 5へ切り替えて再実行 | エクスプロイト(攻撃コード)の生成、コンパイル済みバイナリの脆弱性スキャン、ペネトレーションテスト |
フロンティアLLM開発 | Sonnet 5へ切り替えて再実行 | 特定のAI向け半導体でのカーネル開発など、最先端LLMの開発に関わる一部の作業 |
生物学 | 切り替えずにブロック | 深刻な生物学的被害につながりうる依頼 |
蒸留(推論の抽出) | 切り替えずにブロック | 思考過程をそのまま書き出させる依頼など |
ソースコードの脆弱性を探すといった、安全なコーディングのための作業は引き続きSonnet 5.5で行えます。「なぜそうしたのか説明して」といった通常の質問も、蒸留対策の対象にはなりません。
情シスが押さえるべき3つの挙動
1つ目は、判定の対象がユーザーの入力だけではない点です。メモリ、コネクタ経由で取り込んだ内容、Web検索の結果、ファイルもチェックされます。社員が自分で書いていない内容がきっかけで、切り替えやブロックが起こることがあります。
2つ目は、アプリとAPIで既定の動きが違う点です。
利用経路 | 自動切り替え | 情シスの対応 |
|---|---|---|
Web、デスクトップ、モバイル、Cowork、Claude Code、Claude Design、Claude for Microsoft 365など | 既定で有効。切り替えは画面に通知され、回答には応答したモデル名が表示される。切り替え後はそのチャットの間Sonnet 5のまま | 「Sonnet 5.5を選んだのに別モデルになった」という問い合わせに備え、仕組みを周知する |
Claude API | 既定では無効。開発者が有効化・設定する必要がある | 社内ツールで拒否時の処理(フォールバック設定や再試行)が実装されているかを確認する |
自動切り替えは、利用者が「設定>機能」(Claude Codeでは「Config>MODEL & OUTPUT」)の「Switch models when a message is flagged」でオフにできます。オフにすると、判定されたチャットは切り替わらずに一時停止します。
3つ目は、課金の扱いです。応答前にブロックされた場合、生物学・蒸留・LLM開発の分類器による拒否は課金されますが、それ以外の分野は課金されません。応答の途中で止まった場合は、そこまでのトークンが課金されます。Sonnet 5に切り替わった場合の応答は、Sonnet 5の料金で別途課金されます。
セキュリティ業務への影響
SOC業務や脆弱性診断の補助にClaudeを使っている場合、Sonnet 5.5を指定しても実際にはSonnet 5が応答している場面が出てきます。回答の質が想定と違うときは、モデルの不具合を疑う前に、切り替えが起きていないかをログや画面表示で確認してください。
防御側の専門家向けの審査制プログラム「Cyber Verification Program」は、公開時点ではSonnet 5.5に対応していません。近く対象を広げ、段階的により高度な機能を使えるようにする予定とされています。それまでの間、自社コードの脆弱性検出が目的であれば、Claude Code Securityのような専用の仕組みを使うほうが、切り替えを気にせずに運用できます。
自動切り替えはチャット画面だけでなく、業務タスクを任せるCoworkでも同じように働きます。Coworkに定型業務を任せている部門では、途中でモデルが切り替わっても成果物の確認手順が変わらないよう、Claude Coworkの管理ポイントとあわせて運用ルールを見直しておきましょう。
安全性評価で押さえる点|改善と、残る課題を分けて読む
約1,850のシナリオで行う自動行動監査では、Sonnet 5.5はほとんどの指標でSonnet 5と同等以上でした。一方で、System Cardにはいくつかの課題も記載されており、評価結果だけで運用ルールを緩めるのは早計です。
改善が確認された点
アライメント(人間の意図との整合性)、悪用への耐性、正直さのほとんどの指標で、Sonnet 5と同等以上
サンドボックス(隔離環境)から抜け出そうとする頻度の低さで、最良だったOpus 5.5に迫った
コンテナの境界を探ろうとする傾向は、同社のモデルの中で最も低かった
ユーザーの意図と相反する目標を追求している証拠は見つからなかった
課題として押さえておく点
Anthropicは、どの評価もすべての失敗を確実に捉えられるわけではなく、Sonnet 5.5にも未発見の傾向がありうると明言しています。System Cardでは次の点も報告されています。【要確認:System Card原文での記載内容と数値】
事実に関するハルシネーション(もっともらしい誤り)が、Opus 5.5より多い
複数ターンの安全性評価で、追跡・監視、暴力的過激主義、ヘイト・差別の領域がSonnet 5から後退した
シミュレーション環境で、実在の企業らしいと気づきながら漏えいしたパスワードでログインした事例がある(実在のシステムへの影響はなし)
情シスの運用に置き換えると、「事実確認が必要な調査はOpus 5.5か人の確認を挟む」「エージェントに渡す認証情報と権限を最小限にする」の2点が特に重要です。メール本文や取引先資料をそのまま読み込ませる使い方では、文中に仕込まれた指示でAIを操るプロンプトインジェクションへの備えも、引き続き欠かせません。
情シスの活用ポイント|Opus 5.5との使い分けと、先に決める統制ルール
Sonnet 5.5を最も活かせるのは、件数が多く、1件ごとの作業範囲がはっきりした業務です。Opus 5.5と役割を分け、既定モデルとeffortを業務ごとに決めてから展開するのが基本になります。
使い分けの目安
業務の性質 | 向くモデル | 例 |
|---|---|---|
範囲が明確で件数が多い | Sonnet 5.5(low〜medium) | 社内問い合わせの一次回答、定型メールの下書き、議事録の要約 |
資料作成・テンプレートに沿った成果物 | Sonnet 5.5(medium〜high) | 報告スライド、手順書、管理台帳の整形 |
日常的なコード修正・レビュー | Sonnet 5.5 | 社内スクリプトのバグ修正、単純〜中程度のレビュー |
長時間の無人実行、判断の持続が必要 | Opus 5.5 | 大規模なシステム移行、複数リポジトリにまたがる作業 |
事実の正確さが最重要 | Opus 5.5+人の確認 | ベンダー比較、セキュリティ動向の調査メモ |
なお、Opus 5.5でも足りない最高難度の作業には、上位のFable 5.1という選択肢もあります。単価はSonnet 5.5の5倍になるため、対象業務を絞って使うのが前提です。料金体系やFable 5からの変更点は、Claude Fable 5.1の解説記事で整理しています。
公式ブログでは、上場企業の決算資料とスライドのテンプレートを渡して10枚の業績レビューを作らせたところ、専門家2人が「最初の草稿のまま送れる」と判断したと紹介されています。定例報告や経営会議向け資料の下書きは、手直しの手間を減らしやすい領域です。
社内ヘルプデスクへの組み込みを検討する場合は、回答の元になるFAQやナレッジが整っていることが前提です。Zendeskの報告のように判断ミスが減っても、元の情報が古ければ誤った回答は防げません。問い合わせ対応をAIで効率化する具体的な形は、AdminaのAIヘルプデスクの紹介ページでも確認できます。
展開前に決めておきたい統制ルール
モデルとeffortの既定値を文書化する Sonnet 5.5、Opus 5.5、Fable 5.1をどの業務に使い、effortをどう設定するかを決めておきます。数週間後にはHaiku 5.5も加わる予定のため、見直す前提で作るのが現実的です。
自動切り替えの設定方針を決める セキュリティ部門など切り替えが起きやすい部署では、自動切り替えをオンのままにするか、オフにして手動で判断させるかを決めておきます。APIを使う社内ツールでは、拒否時の処理を必須の実装項目にしてください。
コネクタとメモリの接続先を絞る セーフガードはコネクタ経由の内容やファイルも判定対象にします。業務に不要な外部サービスをつながない運用は、誤判定を減らすうえでも、情報漏えいを防ぐうえでも有効です。MCPで外部サービスとつなぐ場合の統制は、MCP企業導入のセキュリティガイドで解説している考え方が参考になります。
個人契約での利用を把握する Sonnet系は多くのプランで使えるモデルのため、業務で個人契約のClaudeを使う社員が出やすくなります。会社が管理していないアカウントに社内情報が入る状態は、典型的なシャドーAIです。規程で禁止するだけでは実態がつかめないため、AdminaのシャドーAI管理機能のように、社員が実際に使っているAIサービスを検知できる仕組みを用意しておくと、ルールの形骸化を防げます。
企業規模別|情シスが今やるべきこと
優先度は、Claudeの使われ方によって変わります。小さな組織は「誰が使っているかの把握」、中規模は「既定モデルと予算の更新」、大規模は「経路ごとの差分管理とセーフガードの運用設計」から着手すると効率的です。
50名未満の企業
この規模では、社員が個別に契約したClaudeや、開発者個人のAPIキーが業務で使われている状態が起きやすくなります。まずは使われ方を把握し、会社として認める経路を決めてください。
業務で使われているClaudeの契約形態(個人プラン/Team/API)を洗い出す
「Sonnet 5.5を選んでもSonnet 5に切り替わることがある」仕組みを、利用者に一度周知する
AI利用ガイドラインがなければ、入力してよい情報の範囲だけでも先に定める(項目の考え方はAI利用ガイドラインの作り方を参照)
50〜300名の企業
部門ごとにClaudeが広がり始めている規模です。既定モデルの切り替えと予算の見直しを、開発部門と一緒に進める段階にあります。
TeamまたはEnterpriseで、日常業務の既定モデルをSonnet 5.5にするかを判断する
APIを使う社内ツールについて、5つの破壊的変更と挙動の変化を開発部門に確認してもらう
代表業務でlow・medium・highを比較し、部門ごとのeffortの推奨値を決める
Opus 5.5で処理している業務のうち、Sonnet 5.5に移せるものを選び、予算を再見積もりする
300名超の企業
Claude APIに加え、Amazon Bedrock、Google Cloud、Microsoft Foundryなど複数の経路でClaudeを使っていることが多い規模です。経路ごとの仕様差と、セーフガードを前提にした運用設計が主な論点になります。
利用経路ごとの差分を一覧化する(旧コンピューター操作ツールの互換性など)
2026年8月31日以降に作成したAPIアカウントの有無を確認し、思考ブロックの紐づけの影響範囲を把握する
拒否(HTTP 200+
stop_reason: "refusal")とモデル切り替えの発生件数を監視する仕組みを用意するセキュリティ部門の利用について、自動切り替えの設定方針とCyber Verification Programの申請要否を検討する
ベンチマークに頼らず、自社の代表業務で品質とコストを比較する評価手順を整える
よくある質問(FAQ)
Q. Sonnet 5で動いている社内ツールは、モデル名を変えるだけで動きますか?
A. 思考を無効にしておらず、強制ツール使用、旧コンピューター操作ツール、Sonnet 5と組み合わせたadvisorツールを使っていなければ、多くの場合そのまま動きます。ただし temperature などを既定以外にしている場合や、会話履歴を途中で編集する実装は400エラーになる可能性があります。effortの効き方も変わるため、品質の再確認は必要です。
Q. Opus 5.5とSonnet 5.5、どちらを既定モデルにすべきですか?
A. 日常業務の既定はSonnet 5.5、長時間の無人実行や判断の持続が必要な業務はOpus 5.5、という使い分けが現実的です。Anthropic自身が、複雑で自由度の高い作業ではOpus 5.5が明らかに優れていると述べています。キャッシュを多用する使い方では両モデルの費用差が2倍より小さくなるため、実測で判断してください。
Q. 社員から「Sonnet 5.5を選んだのに別のモデルが回答した」と問い合わせがありました。不具合ですか?
A. 不具合ではなく、セーフガードによる自動切り替えの可能性が高いです。サイバーセキュリティやLLM開発に関わる依頼と判定されると、Sonnet 5に切り替えて再実行されます。入力した文章だけでなく、添付ファイルやコネクタ経由の内容がきっかけになることもあります。依頼内容を編集して再試行すると解消する場合があります。
Q. 脆弱性診断の業務でSonnet 5.5は使えますか?
A. ソースコードの脆弱性を探すといった安全なコーディングのための作業は使えます。一方、攻撃コードの生成、コンパイル済みバイナリの脆弱性スキャン、ペネトレーションテストなどは、Sonnet 5への切り替え対象です。専門的な診断業務は、Cyber Verification Programの対象拡大を待って申請を検討してください。
Q. データの保持や学習利用はどうなりますか?
A. Sonnet 5.5はゼロデータ保持(ZDR)に対応しています。適用条件は契約形態によって異なるため、自社の契約内容を確認してください。
Q. Haiku 5.5の登場を待つべきですか?
A. 用途によります。Haiku 5.5は今後数週間で公開予定と発表されていますが、日付や価格は未発表です。日常業務や資料作成はSonnet 5.5の検証を今から始め、大量・低単価の処理だけHaiku 5.5の発表を待って判断する進め方が無駄がありません。
まとめ|「安くなった中位モデル」を、使い分けと統制を決めてから展開する
Claude Sonnet 5.5は、Sonnet 5と同じ単価のまま、多くの業務でOpus 5.5に迫る性能を持つようになったモデルです。コスト面の恩恵は大きい一方で、APIの破壊的変更、Sonnet 5への自動切り替え、ハルシネーションなどの残る課題という、情シスが手当てすべき変化も同時に持ち込んでいます。
性能の数字に反応して一気に切り替えるより、まず自社の使われ方を把握し、Opus 5.5との使い分けと予算を決めてから展開するほうが、結果的に早く安全に効果を出せます。最後に、確認項目をチェックリストにまとめます。
Claude Sonnet 5.5 導入前チェックリスト
社内で使われているClaudeの契約形態(個人プラン/Team/Enterprise/API/クラウド経由)を把握した
Sonnet 5.5・Opus 5.5・Fable 5.1の使い分けと、業務ごとのeffortの既定値を決めた
APIを使う社内ツールについて、5つの破壊的変更と
temperatureなどの設定を開発部門と確認したツール呼び出し間テキストの扱いと、拒否レスポンス(HTTP 200)の監視方法を確認した
2026年8月31日以降に作成したAPIアカウントの有無を確認した
アプリでの自動切り替えの仕組みを利用者に周知し、APIでは拒否時の処理を実装した
セキュリティ業務でのSonnet 5への切り替えの発生状況を検証した
実測のトークン消費をもとに、Opus 5.5からの移行対象と予算を再見積もりした
事実確認が必要な業務で、人の確認を挟むルールを定めた
個人契約のAI利用(シャドーAI)を把握・検知する仕組みを用意した
本記事の内容に誤り等がございましたら、こちらからご連絡ください。
監修
Admina Team
情シス業務に関するお役立ち情報をマネーフォワード Adminaが提供します。
SaaS・アカウント・デバイスの管理を自動化し、IT資産の可視化とセキュリティ統制を実現。
従業員の入退社対応や棚卸し作業の工数を削減し、情報システム部門の運用負荷を大幅に軽減します。
中小企業から大企業まで、情シス・管理部門・経営層のすべてに頼れるIT管理プラットフォームです。









