Claude Opus 5.5の料金|値下げで月いくら変わるのか
「Claude Opus 5.5は値下げされたらしいが、結局うちの請求はいくら下がるのか」「40%安いという話と20%値下げという話、どちらが本当なのか」——APIの従量課金でClaudeを使っていると、新モデルが出るたびにこの計算で手が止まります。
結論から言うと、Claude Opus 5.5のAPI料金は入力$4・出力$20(100万トークンあたり)で、Opus 5より単価が20%下がりました。「40%安い」は単価の話ではなく、少ないトークンで仕事を終える分まで含めた総コストについての公式主張です。請求額が確実に下がるのは20%までで、それ以上は使い方次第です。一方、長い資料を何度も読ませる使い方では、キャッシュ読み取りの60%値下げが効き、単価だけで3割以上下がることもあります。
株式会社Fyveは中小企業向けにAIの業務活用を支援しており、私自身もClaude Codeを毎日の実務で使っています。この記事では、Anthropicの公式料金をもとに、3つの使い方で月額をOpus 5と並べて試算し、どこで差が出るのかを計算の過程ごと示します。
先に結論:確実に下がるのは20%、そこから先は使い方で決まる
Claude Opus 5.5は2026年9月22日(米国時間)に公開されました。料金について押さえるべき点は3つです。
- 単価は入力・出力とも20%減:入力$5→$4、出力$25→$20。同じトークン数なら、請求は必ず2割下がる
- キャッシュ読み取りは60%減:$0.50→$0.20。入力単価のちょうど5%で、長い資料を繰り返し読ませる用途ほど下がり幅が大きい
- 「40%安い」は総コストの主張:Anthropicは「一般的なワークロードでOpus 5より40%安く動く」と発表している。これは単価の20%減に、同じ仕事を少ないトークンで終える分を合わせた数字で、単価が40%下がったわけではない
予算を組むときは「最低でも20%」を確実な線として置き、残りは自分の仕事で使用量を測ってから見込むのが安全です。以下、単価表・月額試算・注意点の順に見ていきます。
Claude Opus 5.5のAPI料金一覧(2026年9月23日時点)
Anthropicの発表とモデル概要ドキュメントに載っている単価を、Opus 5と並べると次のとおりです。単位はすべて米ドル・100万トークンあたりです。
区分 | Opus 5.5 | Opus 5 | 差 |
|---|---|---|---|
入力 | $4 | $5 | −20% |
出力 | $20 | $25 | −20% |
キャッシュ書き込み(5分) | $5 | $6.25 | −20% |
キャッシュ書き込み(1時間) | $8 | — | |
キャッシュ読み取り | $0.20 | $0.50 | −60% |
Batch API | 入出力とも50%引き($2/$10) | — | |
fast mode(入力/出力) | $8/$40 | $10/$50 | −20% |
米国内限定推論 | 入出力とも1.1倍($4.40/$22) | — |
※Batch APIと米国内限定推論のカッコ内は、公式の倍率を入力$4・出力$20に掛けた値です。Opus 5の欄の「—」は、今回参照した公式資料に比較できる記載がなかった項目です。

表の中で、読み違えやすい項目を3つ補足します。
キャッシュの書き込みは2種類、読み取りは入力の5%
プロンプトキャッシュは、同じ資料や指示を何度も送るときに、2回目以降を安く読ませる仕組みです。最初の1回は「書き込み」として通常の入力より高く払い、以降は「読み取り」として安く払います。
Opus 5.5では、書き込みが5分保持で$5(入力の1.25倍)、1時間保持で$8(入力の2倍)です。読み取りは$0.20で、入力$4の5%にあたります。具体的に、5万トークンの社内マニュアルを1回送る費用で比べると次のようになります。
送り方 | 5万トークンあたりの費用 |
|---|---|
普通に入力として送る | $0.20 |
キャッシュに書き込む(5分) | $0.25 |
キャッシュに書き込む(1時間) | $0.40 |
キャッシュから読み取る | $0.01 |
1回きりの質問なら、キャッシュに書き込むほうが割高です。同じ資料に2回目、3回目と質問を重ねるほど、1回$0.01の読み取りが効いてきます。なお、キャッシュできるプロンプトは512トークン以上です。
Batch APIは急がない処理を半額にする
Batch APIは、リクエストをまとめて送り、結果をあとで受け取る方式です。入出力とも50%引きになるため、Opus 5.5では実質$2/$10になります。即答が要らない処理、たとえば夜間にまとめて回す文章生成や分類であれば、これだけで請求は半分です。最大出力もBatch APIとbetaヘッダの併用で12.8万トークンから30万トークンまで広がります。
米国内限定推論は1.1倍
推論を米国内に限定する場合は、入出力とも1.1倍の単価になります。入力$4.40・出力$22です。データの処理地域に社内規程がある場合は、この1割増しを見込んでおきます。
読者特典・無料ダウンロード最新AI「4モデル」、実務で比べてみた。無料でダウンロード →月額はいくら変わるのか|3つの使い方で試算
単価表だけでは請求額の感覚がつかみにくいので、中小企業でよくある使い方を3つ想定し、Opus 5とOpus 5.5の月額を並べます。すべて自分で検算できるよう、前提と計算式を書いておきます。
共通の前提:1ドル=150円で計算/料金は2026年9月23日時点の公式単価/トークン数は仮定の値で、実際の請求はお使いの内容で変わります/税や為替手数料は含めていません。
パターンA:社内の文章作成・問い合わせ対応(キャッシュなし)
社員がメールの下書きや社内文書の要約に使う想定です。1回あたり入力3,000トークン・出力1,000トークン、1日100回、月22営業日とします。月の合計は入力660万トークン、出力220万トークンです。
内訳 | Opus 5 | Opus 5.5 |
|---|---|---|
入力 6.6M × 単価 | $33.00 | $26.40 |
出力 2.2M × 単価 | $55.00 | $44.00 |
月額(ドル) | $88.00 | $70.40 |
月額(1ドル=150円) | 13,200円 | 10,560円 |
差は月2,640円、ちょうど20%です。キャッシュを使わない素直な使い方では、単価の値下げ幅がそのまま請求に出ます。
パターンB:長い社内マニュアルを読ませて質問に答える(キャッシュあり)
5万トークンの社内マニュアルを毎回読ませ、社員の質問に答えさせる想定です。質問は1回500トークン、回答は800トークン、1日200回×22日で月4,400回とします。マニュアル部分はキャッシュし、書き込みは1日20回発生すると仮定しました(5分保持を使用)。
- キャッシュ書き込み:440回 × 5万トークン = 2,200万トークン
- キャッシュ読み取り:残り3,960回 × 5万トークン = 1億9,800万トークン
- 質問部分の入力:4,400回 × 500トークン = 220万トークン
- 出力:4,400回 × 800トークン = 352万トークン
内訳 | Opus 5 | Opus 5.5 |
|---|---|---|
キャッシュ書き込み 22M | $137.50 | $110.00 |
キャッシュ読み取り 198M | $99.00 | $39.60 |
入力 2.2M | $11.00 | $8.80 |
出力 3.52M | $88.00 | $70.40 |
月額(ドル) | $335.50 | $228.80 |
月額(1ドル=150円) | 50,325円 | 34,320円 |
差は月16,005円、約32%です。単価の20%減に加えて、読み取り単価の60%減が効いているためです。読むトークンの大半がキャッシュ読み取りになる使い方ほど、値下げの恩恵は20%を超えます。
参考までに、同じ使い方をキャッシュなしでOpus 5.5に送ると、入力だけで2億2,220万トークン×$4=$888.80、出力と合わせて月$959.20(143,880円)になります。モデルの値下げよりも、キャッシュを使うかどうかのほうが請求額への影響は桁違いに大きいのです。
パターンC:商品説明文を夜間にまとめて生成(Batch API)
ECの商品説明文を月1万件作る想定です。1件あたり入力2,000トークン(商品情報と書き方の指示)、出力800トークンとします。月の合計は入力2,000万トークン、出力800万トークンです。
内訳 | Opus 5(通常) | Opus 5.5(通常) | Opus 5.5(Batch) |
|---|---|---|---|
入力 20M | $100 | $80 | $40 |
出力 8M | $200 | $160 | $80 |
月額(ドル) | $300 | $240 | $120 |
月額(1ドル=150円) | 45,000円 | 36,000円 | 18,000円 |
通常の呼び出しのままならOpus 5から20%減の36,000円、急がない処理としてBatch APIに回せば18,000円です。Opus 5の通常呼び出しと比べると、半額以下になります。

3つの試算から分かること
- キャッシュを使わない使い方:下がり幅は単価どおりの20%
- 同じ資料を繰り返し読ませる使い方:読み取り単価の60%減が加わり、この試算では約32%
- 急がない大量処理:Batch APIに回すと、Opus 5.5の通常料金からさらに半額
つまり「値下げでいくら得するか」は、モデルを替えるだけでなく、キャッシュとBatch APIを使える形に処理を組み直せるかで大きく変わります。
「40%安い」は単価20%減に何を足した数字なのか
ここまでの試算は、Opus 5とOpus 5.5で同じトークン数を使う前提で計算しました。Anthropicの「40%安い」という主張は、そこにもう一つの要素を足しています。Opus 5.5は、Opus 5と同等の品質に「約半分のターン数・時間・出力トークン」で到達する、という公式発表です。
出力トークンが減れば、単価が同じでも請求は減ります。私が手元のClaude Code(v2.1.280・Maxサブスク認証)で、郵便番号を整形するPython関数を書かせる同じ課題を各3回投げたところ、出力トークンの中央値はOpus 5が2,079、Opus 5.5(既定設定)が1,507でした。約3割少ない量です。
この中央値に出力単価を掛けると、1,000回あたりの出力費用はOpus 5が約$52、Opus 5.5が約$30で、出力分だけで見れば約4割減になります。ただし、これは1種類の小さな課題を各3回試しただけの結果です。出力トークンも1,028〜2,473とばらつきが大きく、1回だけ測ると逆転することもありました。「どの仕事でも4割下がる」とは言えません。
なお、Opus 5.5は思考の深さを決めるeffortの既定値が、Opus 5の high から medium に下がっています。手元の課題ではeffortを high に揃えても出力トークンの中央値は1,532で、既定設定とほぼ同じでした。トークンが減った理由は、既定値が下がったことだけではなさそうです。
実務での進め方としては、予算は単価の20%減で組み、自分の代表的な処理を数回ずつ流してトークン数を比べてから、上積み分を見込むのが確実です。
fast modeの料金|単価は2倍、途中でオンにすると会話全体を1回払う
fast modeは、同じモデルのまま出力を最大2.5倍速くするモードです。別のモデルに切り替わるわけではなく、品質は同じとされています。Opus 5.5のfast modeの単価は入力$8・出力$40で、通常の2倍です(Opus 5のfast modeは$10/$50)。
見落としやすいのが、会話の途中でオンにした場合の扱いです。公式ドキュメントによると、途中でfast modeをオンにすると、それまでの会話全体をfast modeのキャッシュなし入力単価で1回払うことになります。たとえば会話が20万トークンまで育ったところでオンにすると、0.2M×$8=$1.60(240円)がその時点で1回かかります。
そのため、速さが必要な作業だと分かっているなら、セッションの最初にオンにするほうが安く済みます。長い作業の終盤で「急ぎたいから」とオンにするのが、最も割高な使い方です。
ほかにも次の制約があります。
- Claude Codeの月額プランで使う場合も、fast modeはプランの枠ではなく利用クレジット(usage credits)から支払う
- Amazon Bedrock・Google Cloud・Microsoft Foundry・Claude Platform on AWSでは使えない
- fast modeはresearch preview(試験提供)で、仕様や価格が変わる可能性がある
ほかのモデルと単価を比べると
Opus 5.5の単価を、Anthropicのほかのモデルと他社の上位モデルに並べると次のとおりです(入力/出力・100万トークンあたり)。
モデル | 入力 | 出力 | Opus 5.5との比 |
|---|---|---|---|
Claude Fable 5.1 | $10 | $50 | 2.5倍 |
GPT-6 Astra(OpenAI・2026年9月4日時点) | $10 | $50 | 2.5倍 |
Claude Opus 5.5 | $4 | $20 | — |
Claude Sonnet 5 | $2 | $10 | 0.5倍 |
Claude Haiku 4.5 | $1 | $5 | 0.25倍 |
Fable 5.1とGPT-6 Astraは、どちらもOpus 5.5の2.5倍の単価です。Anthropicはモデル一覧で「迷ったら大半の用途はOpus 5.5から始め、より難しい推論や長時間のエージェント作業、Opus 5.5を高effortにしても足りない場合はFable 5.1」と案内しています。まずOpus 5.5で回し、足りない処理だけ上位に回す組み方が、費用の面では自然です。Fable 5.1の料金の詳細は、こちらの記事にまとめています。
前世代のOpus 5を当面使い続ける場合の費用設計は、Opus 5の料金記事が参考になります。Opus 5は現在もlegacy(旧世代)モデルとして利用できます。
Claude Codeやclaude.aiの月額プランで使う場合
ここまでの話はAPIの従量課金についてです。Pro・Maxなどの月額プランの料金は、この記事では扱いません。どのプランでOpus 5.5が使えるか、無料で使えるかどうかは、プラン別の記事で整理しています。
料金を見積もるときの注意点
最後に、Opus 5.5の費用を社内で見積もるときに外しやすい点をまとめます。
- 料金は米ドル建て:円での予算は為替で動く。この記事は1ドル=150円で計算している
- 日付を添えて記録する:単価は2026年9月23日時点。fast modeは試験提供で変わりうる。契約・予算化の前に公式のモデル概要と発表ページで最新の単価を確認する
- 「40%」で予算を組まない:確実なのは単価の20%減まで。上積みは自分の処理で測ってから
- effortを決めてから測る:既定は
medium。移行ガイドも、effortを明示したうえで、選んだeffortでコストとレイテンシを測り直すよう推奨している - キャッシュとBatchの余地を先に探す:試算のとおり、モデルの値下げより処理の組み方のほうが請求への影響が大きい
トークンの数え方や、キャッシュ・Batchを含むClaude API料金の基本的な節約の考え方は、こちらで解説しています。
まとめ
- Claude Opus 5.5のAPI料金は入力$4・出力$20(100万トークンあたり・2026年9月23日時点)。Opus 5から単価は20%減
- 「40%安い」は、少ないトークンで終える分まで含めた総コストの公式主張。単価が40%下がったわけではない
- キャッシュ読み取りは$0.20で入力の5%。長い資料を繰り返し読ませる試算では、月額が約32%下がった
- 急がない大量処理はBatch APIで半額($2/$10)
- fast modeは単価2倍($8/$40)。途中でオンにすると会話全体を1回払うので、使うならセッションの最初に
- 予算は20%減で組み、自分の処理で数回測ってから上積みを見込む
値下げの恩恵を大きくするのは、モデルの切り替えそのものより、キャッシュやBatch APIに載せられる処理を見つけることです。今の使い方に組み直せる箇所がないか、一度見直してみてください。
最新AI「4モデル」、実務で比べてみた。

Opus 5.5・Opus 5・Fable 5.1・GPT-6 Astra に同じ5つの仕事を投げた実測(全31ページ)
公式ベンチでは、Opus 5.5 が上位の Fable 5.1 や GPT-6 Astra を多くの項目で上回りました。では実際の仕事ではどうか。LP・CSV集計・営業スライド・3D商品ページ・請求書の5つを4モデルに同じ条件で頼み、時間・費用・出来を全部並べました。正解のある課題は4モデルとも全問正解。差が出たのは、速さと費用と、細かい指示の守り方でした。
- 5つの仕事 × 4モデル=20本の実行記録を、時間と費用まで全件掲載
- 成果物そのものを4つ並べて比較(LP・スライド・回せる3D)
- Opus 5 と同じ作り込みを、Opus 5.5 がどれだけ短く終えたか
- 細かい指示を最後まで守ったのはどれか——仕事別の早見表と判断フローつき
メールアドレス登録で他にも様々な資料を閲覧できます








+6PDF 15点・合計400ページ + すぐ使えるzip素材 3点
どれも登録後の受け取りページから、まとめてダウンロードできます。
毎週配信の無料ニュースレター「AIネイティブ超研究」の購読特典です。メール登録後すぐ、受け取りページのご案内が届きます。そこにはこの資料に加えて、過去の特典もすべてまとめて置いてあります。あわせて、AI活用に関するお知らせやお役に立てそうなご案内をお送りすることがあります。解除はいつでも1クリック。
御社の業務に合わせたClaude Code導入支援
「AIツールを導入したが、現場で使われない」を終わらせる。
業務課題のヒアリングから設計、ハンズオン実践、運用定着まで一貫して支援します。