Claude Opus 5.5リリース:API料金2割減・キャッシュ読込6割減と、有料プランの利用枠拡大・リセット枠を整理する

2026年9月22日にリリースされたClaude Opus 5.5について、API料金(入出力20%減・キャッシュ読込60%減)と実質コストの試算、Claude有料プランの5時間利用枠の拡大と保存できるリセット枠、thinking無効化やtool_choiceなどAPI移行時の注意点を、Anthropicの公式発表・公式ドキュメントで確認しながら整理します。

著者
岡崎 太
CTO / AIアーキテクト
公開日
読了時間
12分で読めます
Share

Claude Opus 5.5は、2026年9月22日にリリースされました。前回の7モデル比較記事では公開評価のスコアを中心に見ましたが、今回はお金と利用枠に絞ります。実務上の要点は次の3つです。

  1. API料金の引き下げ:入力・出力・キャッシュ書込が20%減、キャッシュ読込は60%減。
  2. Claude有料プランの5時間利用枠の拡大:Pro・Max・Team・席課金型Enterpriseが対象。単価低下により週間枠も実質的に余裕が増える。
  3. 保存できる利用枠リセットの配布:任意のタイミングで残量を満タンに戻せる1回分のリセット(2026年10月22日まで)。

本記事は2026年9月24日時点のAnthropicの公式発表、公式ドキュメント、公式Xアカウントの投稿を照合して書いています。当社でOpus 5.5を計測した実測記事ではありません。数値の出典は各節に付けています。

早見表

項目 内容
リリース日 2026年9月22日
APIモデルID claude-opus-5-5(Amazon Bedrockでは anthropic.claude-opus-5-5)
提供先 Claude API、Amazon Bedrock、Claude Platform on AWS、Google Cloud、Microsoft Foundry。Claudeアプリでは有料プランの既定モデル(@ClaudeDevs投稿)
コンテキスト 100万トークン
最大出力 12.8万トークン(Batch APIではベータヘッダ付きで30万トークン)
思考モード Adaptive Thinkingが常時有効。無効化や budget_tokens 指定は400エラー
effort 既定値 medium(Opus 5は high)
速度 Opus 5比で出力生成が30%以上高速(Anthropic公表値)。Fast modeでは最大2.5倍(Anthropic公表値。比較基準は明示されていない)
位置づけ 長時間のエージェント型コーディングと知識労働向け

出典:Claude Opus 5.5 発表ページ、モデル概要、What’s new in Claude Opus 5.5、@ClaudeDevs 投稿(2026年9月22日)

API料金と実質コスト

標準API料金はOpus 5比で入力・出力・キャッシュ書込が20%減、キャッシュ読込は60%減です。 キャッシュ読込は基本入力単価の5%(従来モデルは10%)に設定されており、長時間のClaude Codeやエージェント運用ほど効きます。

課金対象(USD / 100万トークン) Opus 5.5 Opus 5 変化
入力 $4 $5 20%減
出力 $20 $25 20%減
キャッシュ書込(5分) $5 $6.25 20%減
キャッシュ書込(1時間) $8 $10 20%減
キャッシュ読込 $0.20 $0.50 60%減
Batch API 入力 / 出力 $2 / $10 $2.50 / $12.50 20%減
Fast mode 入力 / 出力 $8 / $40 $10 / $50 20%減

出典:Pricing(2026年9月24日確認)。Fast modeはリサーチプレビューで、Claude APIのみの提供です。Amazon Bedrock・Claude Platform on AWS・Google Cloud・Microsoft Foundryでは使えません。また、Opus 5.5自体の料金も、これらのクラウド経由では各社の価格表に従います。

Anthropicは発表ページで、典型的なワークロードではOpus 5より40%安く運用できる、という趣旨の説明をしています。内訳は公表されていませんが、単価の20%減だけでは40%に届かないため、effort の既定値が medium に下がったことによる思考トークンの減少や、タスク完了までのトークン効率の改善が含まれていると考えられます(筆者の推定)。実際の削減率はプロンプト量、ツール呼び出し回数、出力量、キャッシュヒット率、effort の設定で変わります。

コスト試算例

1回のエージェント処理で次のトークンを消費する場合を考えます。

  • 新規入力:200万トークン
  • キャッシュ読込:1,000万トークン
  • 出力:100万トークン
  • キャッシュ書込(5分):200万トークン

Opus 5.5では、2×$4 + 10×$0.20 + 1×$20 + 2×$5 = $40 です。

同じトークン量をOpus 5で処理すると、2×$5 + 10×$0.50 + 1×$25 + 2×$6.25 = $52.50 です。

この例では約24%減です。キャッシュ読込の比率がもっと高い長期セッションでは差が広がり、逆に短い単発の質問応答でキャッシュをほぼ使わない構成では、削減幅は入力・出力の20%程度に収まります。ただし、この20%は「同じトークン量なら」の話です。後述のとおりOpus 5.5は同じ effort でも1ターンあたりの思考量が増える傾向があるため、タスク当たりの費用が20%減を下回ることもあり得ます。「40%」も「20%」も前提を置いた数字なので、1タスク当たりの費用は自社のワークロードで測って確認してください。

Claudeアプリの利用枠

Anthropicは発表ページで、Claudeのサブスクリプション利用者に対する5時間単位の利用上限の引き上げを告知しました。対象は次のとおりです。

  • Claude Pro
  • Claude Max
  • Claude Team
  • 席課金型Enterprise

公式発表では「5時間枠をどのプランで何メッセージ、何トークンまで増やしたか」という絶対値は公開されていません。一方、Anthropicの開発者向け公式Xアカウント(@ClaudeDevs、2026年9月22日投稿)は、有料プランではOpus 5.5が既定モデルになり、単価が下がった分、5時間枠と週間枠が25%多く使えると説明しています。投稿の文脈からは、この25%は「枠の絶対値が25%増えた」ではなく「同じ枠でOpus 5.5を使うと処理できる量が25%増える」実質値と読めます(1 / 0.8 = 1.25)。発表ページの「5時間枠の引き上げ」と、この25%が同じ施策を指すのか別なのかは、公式には明示されていません。実際の残量はモデル選択、会話の長さ、添付ファイル、思考の深さ、Claude Codeでの利用状況で変わるので、Settings → Usage で確認するのが確実です。

Freeプランについては、公式発表・公式Xのいずれにも記載がなく、本記事では確認できていません。

リセット枠

ローンチ施策として、有料サブスクリプション利用者に利用枠のリセットが1回分配布されています。上限に達しているかどうかにかかわらず、使った時点で残量を満タンに戻せるリセットで、すぐに消費せず保存しておき、重要な長時間作業の前など任意のタイミングで使えます。

@ClaudeDevsの投稿によると、Pro・Max・Teamでは Settings → Usage から適用でき、2026年10月22日まで使えます。Enterpriseでの扱いは投稿に含まれておらず、管理者設定に依存する可能性があります。

リセットの仕組みはClaudeヘルプセンターの「What is a limit reset?」に説明があります。使う前に押さえておきたい点は次の4つです。

  • 戻るのは残量だけで、週間枠の更新スケジュールは動かない。リセットを使うと、対象の枠(5時間枠または週間枠。どちらが対象かは表示されるリセットの種類で決まります)の残量がその場で満タンに戻りますが、週間枠が更新される曜日・時刻はもとのままです。「リセットしたから、ここから1週間分」にはなりません。更新日の直前に使っても更新日は延びないので、使うタイミングは Settings → Usage の更新スケジュールを見て決めます。
  • 取り消せない。Settings → Usage の「Reset for free」を押して確定すると元に戻せません。保存しておく価値があるのは、この不可逆性のためです。
  • 超過分の返金や使用量クレジットの変更はない。上限超過後に従量課金で使った分は戻りません。
  • Web版またはClaude Desktopから操作する。Claudeモバイルアプリと Claude Code(ターミナル・IDE)からは、2026年9月24日時点では適用できません。有効期限(今回の配布分は2026年10月22日)は Settings → Usage に表示されます。
施策 内容 注意点
5時間利用枠の拡大 Pro・Max・Team・席課金型Enterpriseが対象 プラン別の具体的な上限値は未公表。「25%多く使える」は単価低下による実質値
保存できるリセット 有料サブスクリプション利用者に1回分 Settings → Usage から適用。2026年10月22日まで。週間枠の更新曜日・時刻は動かない。Enterpriseでの扱いは要確認
Opus 5.5の既定化 有料プランのClaudeアプリでOpus 5.5が既定モデル 契約種別・地域・管理者設定で選択可否が異なる場合がある
API値下げ 入出力20%減、キャッシュ読込60%減 クレジット配布や無料API枠とは別。従量課金は引き続き発生する

今回の発表を「キャンペーン」として見た場合、それに当たるのは恒久的な価格改定ではなく、この1回限りのリセット配布です。少なくとも公式発表では、無料APIクレジット、Pro・Maxの月額割引、Team・Enterpriseの値引きといった金額ベースの販促は告知されていません。

API移行の注意点

Opus 5からOpus 5.5へモデルIDを差し替えるだけで動くケースは多いですが、公式ドキュメントは4つの破壊的変更を挙げています。ここでは、それに既定値の変更と応答形式の変更を加えた6点を確認します。

  1. thinkingは無効化できない。thinking: {"type": "disabled"} も {"type": "enabled", "budget_tokens": N} も400エラーになります。thinking を省略するか {"type": "adaptive"} を指定し、思考の深さは output_config.effort で制御します。
  2. effort の既定値が medium に下がった。Opus 5では省略時 high でした。Opus 5と同じ条件で比較したい場合や、品質重視の処理では effort を明示してください。同じ effort でもOpus 5.5は1ターンあたりの思考量が多くなる傾向があるため、max_tokens にも余裕を持たせます。
  3. tool_choice の any と tool は400エラー。auto に戻し、スキーマ通りのJSONが必要なら strict: true(strict tool use)か structured outputs を使います。ツールを呼ばせたい場面はプロンプトで指示します。
  4. 思考ブロックがモデルと会話に結び付く。会話の途中でOpus 5.5から別モデルへ切り替えると、Claude APIではFable 5.1・Mythos 5.1以外は過去の思考ブロックを読めず、APIがエラーを返さずに破棄します(破棄分は課金されません)。2026年8月31日以降に作成したアカウントでは、思考ブロックより前の履歴(system・tools・過去メッセージ)を書き換えて再送すると400エラーになります。会話は追記専用にし、指示の変更は mid-conversation system message で行います。
  5. コンピュータ操作は computer_toolset_20260801 が必須。Claude APIとGoogle Cloudでは旧 computer_20251124 が400エラーになります。Amazon Bedrockでは旧ツールも引き続き動作します。
  6. ツール呼び出しの合間のテキストが thinking ブロックで返る。既定の display: "omitted" では空文字になるため、進捗表示をユーザーに流しているUIはツール呼び出しの間だけ無言になります。エラーは出ないので気づきにくい変更です。thinking.display を設定して受け取ります。

安全面では、Opus 5.5はサイバーセキュリティに加えて生物学の安全分類器を持ち、内部推論をそのまま出力させようとする依頼は reasoning_extraction として拒否されることがあります。発表ページによると、サイバーセキュリティの作業の多くはOpus 4.8へ再ルーティングされます。生物学にはFable 5.1と同じ安全策が適用され、Anthropicの評価ではフロンティアLLM開発に関する作業はOpus 5が引き継いだとされていますが、生物学のフォールバック先はページ上に明記されていません(2026年9月24日時点)。APIでは stop_reason: "refusal" を必ず処理し、必要なら server-side fallback(fallbacks: "default"、ベータ)を設定してください。

Zero Data Retentionは発表ページで利用可能と明記されています。企業導入では契約・リージョン・クラウド経路も含めて個別に確認する価値があります。

開発・導入の視点

  • 長時間エージェントはプロンプトキャッシュ前提で設計する。コードベースの共通コンテキスト、規約、リポジトリ構造、ツール定義を安定させ、キャッシュを壊す変更(system promptへのタイムスタンプ埋め込みなど)を減らすのが基本です。キャッシュ読込が基本単価の5%になった今回、この設計差がそのまま費用差になります。
  • 自律実行のコード修正を本番に接続する場合でも、PR、CI、権限分離、ツール実行承認、予算上限は維持します。フォールバックで別モデルに切り替わる経路がある以上、「どのモデルが何をしたか」をログに残す設計も要ります。
  • 評価は単価ではなく1タスク当たりコストで比べる。effort の既定値が変わったので、Opus 5との比較は同じ effort を明示したうえで、完了までの時間、総トークン、キャッシュヒット率、手戻り時間を並べて測ります。

開発会社・AI導入支援の立場では、まず「Claude Codeでの大規模改修」「RAG付き調査エージェント」「既存コードベースの監査」の3ケースで小規模評価を回すのがよいと考えています。今回の値下げは、単発チャットよりも、長いコンテキストを保持して複数ターン・ツール呼び出しを行うワークロードほど効く変更です。

まとめ

  • API料金は入出力20%減、キャッシュ読込60%減。「40%安い」は内訳非公表のAnthropic評価。思考量が増える傾向もあるため、1タスク当たりの費用は自社ワークロードで実測する。
  • Claude有料プランの5時間枠は拡大されたが、絶対値は未公表。「25%多く使える」は単価低下による実質値。
  • 保存できるリセット枠は1回分、Pro・Max・TeamはSettings → Usageから2026年10月22日まで。残量は戻るが週間枠の更新曜日・時刻は動かず、取り消しもできない。
  • API移行では thinking無効化・tool_choice の強制・旧computer tool・思考ブロックより前の履歴の書き換え(2026年8月31日以降作成のアカウント)が400エラーになる。effort 既定値の変更は品質と費用の両方に影響するので明示する。

関連記事