メインコンテンツにスキップ
株式会社ゼットリンカー
Claude Opus 5.5とは?料金・推論設定と業務での評価方法のイメージイラスト:Claude Opus 5.5はOpus 5より単価が下がりましたが、同じeffort設定でも思考量が増える傾向が公式に明記されています。effort既定値がhigh→mediumに下がる点を含め、エラーの出ない品質低下を避ける測定手順を整理します。
AI

Claude Opus 5.5とは?料金・推論設定と業務での評価方法

Claude Opus 5.5はOpus 5より単価が下がりましたが、同じeffort設定でも思考量が増える傾向が公式に明記されています。effort既定値がhigh→mediumに下がる点を含め、エラーの出ない品質低下を避ける測定手順を整理します。

ゼットリンカー6分で読める

Claude Opus 5.5は、Opus 5より100万トークンあたりの単価が下がりました。ただし公式の「約40%削減」はAnthropicの対象ワークロードでの比較です。さらに公式ドキュメントは、同じeffort設定でもOpus 5より1ターンあたりの思考量が増える傾向を明記しています。単価が下がっても出力トークンが増えれば請求額は下がりません。自社の費用は、入力・出力・キャッシュ・推論設定を揃えて記録してから判断します。

2026年9月23日時点の情報です。

公式発表の料金と仕様を確認する

Anthropicの2026年9月22日の発表公式ドキュメントでは、Claude APIのモデルIDはclaude-opus-5-5です。

項目Opus 5.5Opus 5
入力(100万トークン)4米ドル5米ドル
出力(100万トークン)20米ドル25米ドル
キャッシュ読み取り0.20米ドル
キャッシュ書き込み(5分)5米ドル
キャッシュ書き込み(1時間)8米ドル
バッチ処理入力2米ドル/出力10米ドル
コンテキスト100万トークン100万トークン
最大出力12万8千トークン12万8千トークン

公式が示す「一般的なワークロードで約40%安い」は、単価の差だけでなくキャッシュ読み取りの値下げを含んだ比較です。すべての用途で同じ割合が下がる保証ではありません。

単価が下がっても総額が下がるとは限らない理由

費用は「単価×トークン量」で決まります。公式ドキュメントは、トークン量が増える方向の変化を2つ挙げています。

Claude API組み込みシステム開発について相談するClaude(Anthropic)のAPIを業務システムに組み込む受託開発Claude API組み込みシステム開発を見る

第一に、推論(thinking)を無効にできません。Opus 5では条件つきで無効化できましたが、Opus 5.5ではthinking: {"type": "disabled"}が400エラーになります。推論を切って出力を抑えていた処理は、その手段を失います。

第二に、公式ドキュメントの「Behavior differences」には、同じeffort設定でもOpus 5より1ターンあたりの思考量が増える傾向がある(特にxhighとmax)と記載されています。effortを据え置いても出力トークンは同じとは限りません。

単価は20%下がりますが、出力トークンが25%増えれば出力側の請求額は元に戻ります。請求額の比較は、単価表ではなく実際のトークン量で行います。

エラーは出ないが品質が下がる変更:effort既定値

移行時に最も見落としやすいのが、effortの既定値です。公式の移行ガイドには「its default is medium where Claude Opus 5's is high」と記載されています。

つまり、effortを明示していないコードは、モデルIDを書き換えるだけで推論水準がhighからmediumに下がります。この変更はエラーを出しません。APIは正常に200を返し、処理も完走します。変わるのは出力の質だけです。

そのため、次のような形で表面化します。

  • 移行直後は「安くなった」ように見える(推論量が減るため)
  • 数週間後に「最近AIの精度が落ちた気がする」という現場の声が出る
  • ログにもエラーにも記録が残らないため、原因の特定に時間がかかる

移行時にeffortを明示的にhighと書いておけば、この問題は起きません。費用を下げたい場合も、既定値に任せるのではなく意図的に下げた水準として記録します。

モデル世代交代のたびに使う測定手順

値下げのたびに同じ判断が必要になります。次の手順を一度作れば、次のモデルでも使い回せます。

  1. 切替前に基準値を取る。 代表業務を3件決め、現行モデル・現行設定のまま実行し、下表の欄を埋めます。切替後に取り直せない値があるため、先に取ります。
  2. 設定を揃えて切り替える。 モデルIDだけを変え、effortは切替前と同じ水準を明示します。既定値に任せません。
  3. 同じ3件を再実行し、同じ欄を埋める。 判定者と受入基準は変えません。
  4. 差が出た欄だけを追う。 費用が下がり品質が保てていれば採用します。品質が落ちていればeffortを上げて再計測し、そのときの費用で比較し直します。

比較用の記録表

記録する欄単位取り方
モデルID文字列リクエストに送った値をそのまま
effortlow/medium/high/xhigh/max明示した値。未指定なら「未指定(既定値)」と記録
入力トークンAPIレスポンスのusage(キャッシュ命中・未命中を分ける)
出力トークンAPIレスポンスのusage。thinking分を含む
請求額円または米ドル上記トークン量×単価。月次請求ではなく対象処理分
応答時間リクエスト送信から完了まで
採用できた件数3件中の数修正なしで使えた件数
修正した箇所数と内容どこを直したか。「なんとなく悪い」と書かない
修正にかけた時間担当者の実時間

最後の3行が重要です。トークン費用が半分になっても確認・修正の人件費が倍になれば、総負担は増えています。作業単価1時間11,000円(税込)で換算すれば、修正時間10分は約1,830円です。API費用の数円・数十円より桁が大きくなることは珍しくありません。

架空例:長い仕様書を読ませる調査作業

同じ仕様書を繰り返し参照する調査作業でOpus 5から切り替える場合を考えます。

まず切替前に、代表的な仕様書3件で現行の出力・トークン量・修正時間を記録します。次にモデルIDをclaude-opus-5-5に変え、effortはOpus 5と同じhighを明示して同じ3件を流します。ここでeffortを書き忘れるとmediumで動くため、比較になりません。

キャッシュ読み取りが0.20米ドルと安いため、同じ仕様書を繰り返し参照する使い方ではキャッシュ命中率が結果を左右します。usageの入力トークンは命中分と未命中分を分けて記録します。

品質が落ちた場合はeffortを上げて再計測します。単価が下がっても、effortを上げた分の出力増で総額が変わらない場合もあります。その結果も記録に残します。

提供条件で確認すること

Opus 5.5はClaude API・Amazon Bedrock・Claude Platform on AWS・Google Cloud・Microsoft Foundryで提供されています。提供先ごとにモデルIDの書式が異なり(Bedrockはanthropic.claude-opus-5-5)、課金体系と提供終了時期の扱いも異なります。契約中の提供先の条件を確認します。

公式ドキュメントでは、まずOpus 5.5を使い、より高い推論設定でも品質が足りない場合にClaude Fable 5.1を検討する順番が案内されています。Opus 5の時点ではFable 5.1を先に検討する案内でしたが、順番が変わりました。上位モデルを常用する前提で見積もらず、必要な作業だけを切り分けます。

API実装での破壊的変更(推論の無効化不可、tool_choiceのany・tool廃止、thinkingブロックのモデル束縛、computer_20251124の扱い)は4点あります。手順はClaude Opus 5.5移行|4つの破壊的変更とNext.js実装で整理しています。

よくある質問

Q. Opus 5.5に変えれば費用が40%下がりますか?

公式が示した対象ワークロードでの比較例です。自社の入力量、出力量、キャッシュ比率、effortの設定、確認作業によって結果が変わります。特に同じeffortでも思考量が増える傾向があるため、単価差だけで削減額を見積もらないでください。

Q. モデルIDを書き換えるだけで移行できますか?

推論を無効化していない、tool_choiceでanyやtoolを使っていない、computer useを使っていない場合は、モデルIDの変更でリクエスト自体は通ります。ただしeffortを明示していなければ推論水準がhighからmediumに下がります。エラーは出ないため、設定の明示を推奨します。

Q. 品質が落ちたかどうかは、どう確認すればよいですか?

切替前に同じ業務の出力を記録しておく以外に方法はありません。切替後の出力だけを見ても、以前と比べられません。代表業務3件分の基準値を先に取ってください。

Q. 今使っているOpus 5はすぐ使えなくなりますか?

公式ドキュメントでは、Opus 5は現在も利用可能なモデルとして掲載されています。提供終了の時期は提供先ごとに異なるため、契約先の告知を確認します。

Q. 月額のチャット契約も同じ計算ですか?

月額契約とAPIのトークン課金は分けて確認します。利用上限や追加利用の条件は契約ごとに異なります。本記事の単価はAPIの従量課金の話です。

自社の状況を整理して相談する

まず、比較したい業務、代表的な入力、現在のeffort設定、確認にかけている時間を書き出してください。この記事に合う検討シートとAI相談用プロンプトで、未確認の項目を残したまま整理できます。シートを完成させる前でも、お気軽にご相談いただけます。

前のモデルからの位置づけを確認したい場合は、Claude Opus 5とは?公式料金と複雑な業務の評価方法もあわせてご確認ください。複数サービスを横断した設定の考え方は、生成AIに学習させない設定まとめで整理しています。

キーワード
Claude Opus 5.5Anthropic生成AIAIモデルAI駆動開発Claude

Contact

開発・AI活用のご相談はこちら

「うちの場合はどうかな?」というご質問から大歓迎です。
お話を伺い、最適なご提案をいたします。

お問い合わせ

ご相談・お見積もりは無料です