Claude Opus 5.5は、Anthropicが2026年9月22日に公開した新しいモデルです。
前のOpus 5より安く、速く、大半の仕事で最上位のClaude Fable 5.1に近い出来を出す、というのが公式の説明です。
ただ、発表で目立つ「40%安い」という数字は、料金表の値下げ幅そのものとは違います。
この記事では、料金と性能を一次情報で確かめたうえで、40%の中身と、既定が変わった思考量の設定(effort)の選び方を、使う人の立場で整理します。
Claude Opus 5.5とは 2026年9月に出たOpusの新版
Opusは、Claudeのモデルのうち、長いコーディングや分析のような重い仕事を任せるための系統です。
その最新版がOpus 5.5で、Opus 5の後を継ぎます。
Opus 5の後継で5.5ファミリーの最初のモデル
Anthropicの公式発表は、冒頭でこう書いています。
「Claude 5.5ファミリーの最初のモデルであるClaude Opus 5.5を紹介します。多くの仕事でClaude Fable 5.1と同じ水準の性能を出し、Opus 5より40%安く動きます」(原文は英語、筆者訳)。
同じ発表の中で、Sonnet 5.5とHaiku 5.5も数週間のうちに続くと予告されています。
つまり今回の5.5は、Opusだけで終わる単発の更新ではありません。
何に向けたモデルなのか
Anthropicが開発者向けに出している移行ガイドでは、Opus 5.5の用途を「長時間動くエージェント型のコーディングと知識労働」と位置づけています。
短い質問に答えるだけなら、ここまでのモデルは要りません。
大きなコードの書き換え、何十ページもの資料を読んだうえでの分析、手順の多い作業の自動化といった、時間のかかる仕事で差が出ます。
基本の仕様をOpus 5と並べる
まず、変わった所と変わっていない所を1枚にまとめます。
| 項目 | Opus 5.5 | Opus 5 |
|---|---|---|
| 公開日 | 2026年9月22日 | 先行して提供中(引き続き使える) |
| 扱える長さ(コンテキスト) | 100万トークン | 100万トークン |
| 1回の最大出力 | 12万8,000トークン | 12万8,000トークン |
| 思考量の既定 | medium(中) | high(高) |
| 思考を切る指定 | できない(常に考える) | 思考量がhigh以下なら切れる |
| 出力の速さ | Opus 5より30%以上速い | 基準 |
扱える長さと最大出力は同じです。
変わったのは料金、速さ、それに思考まわりの既定です。
Claude Opus 5.5の料金 100万トークンあたりの単価
料金はAPIで使うときの単価で示されます。
単位は100万トークンです。日本語なら、ざっくり数十万字から百万字前後に当たる量です。
入力と出力は20%下がった
公式発表の料金表では、入力が4ドル、出力が20ドルです。
Opus 5は入力5ドル、出力25ドルだったので、どちらも20%の値下げになります。
キャッシュの読み出しは60%下がった
キャッシュは、同じ前置き(指示文や読み込ませた資料)を毎回送り直さずに済ませる仕組みです。
読み出しの単価は0.50ドルから0.20ドルへ、60%下がりました。
公式発表は、キャッシュの読み出しについて「エージェント型の作業やコーディングの費用の大半を占める」と書いています(筆者訳)。
長い作業ほど、入力や出力よりこの値下げが効いてきます。
たとえば、数百ページの社内資料を最初に読み込ませ、その上で質問を何十回も重ねる使い方では、毎回の読み込み分がキャッシュ読み出しの単価で計算されます。
移行ガイドは、割引が深くなった分、キャッシュが外れたときの損も相対的に大きくなると注意しています。履歴を書き換えない作りにしておくと、キャッシュが外れにくくなります。
高速モードの料金
高速モードは、同じモデルを最大2.5倍の速さで動かす代わりに単価が上がる使い方です。
Opus 5.5では入力8ドル、出力40ドルで、Claude Codeと開発者向けの基盤で使えます。
標準の2倍の単価なので、ふだん使いには向きません。目の前で結果を待ちながら直していく作業のように、待ち時間そのものが損になる場面に絞って使います。
| 区分(100万トークンあたり) | Opus 5.5 | Opus 5 | 下げ幅 |
|---|---|---|---|
| 入力 | 4ドル | 5ドル | 20% |
| 出力 | 20ドル | 25ドル | 20% |
| キャッシュ読み出し | 0.20ドル | 0.50ドル | 60% |
| キャッシュ書き込み | 5ドル | 6.25ドル | 20% |
| 高速モード(入力/出力) | 8ドル/40ドル | 10ドル/50ドル | 20% |
表の数字は、Anthropicの公式発表と開発者向け移行ガイドで確かめたものです。
Claudeのアプリを月額のプランで使っている人は、この単価で直接請求されるわけではありません。プランの人に効くのは、後で触れる利用上限の変化です。
「40%安い」の中身 単価と使う量の掛け算
ここが、この記事でいちばん伝えたい所です。
料金表で下がったのは20%なのに、発表は40%安いと言っています。差の20ポイントはどこから来るのでしょうか。
単価の値下げだけなら20%にとどまる
1回の作業にかかる費用は、単価と、その作業で使ったトークンの量の掛け算で決まります。
単価だけを見れば、どの区分も20%下がった(キャッシュ読み出しは60%)というだけの話です。
同じ仕事を少ないトークンで終える
もう半分は、使う量が減ったことです。
公式発表は「トークンあたりの単価がOpus 5より安く、1つの作業に使うトークンも少ない。差し引きで費用は40%下がる」と書いています(筆者訳)。
同じ発表の中では、社内の試験で「高い思考量のOpus 5と同じ出来を、20〜25%少ない出力トークンで出した」とも述べています。
図のとおり、40%は作業1回あたりで測った結果です。料金表の数字は20%のままです。
自分の使い方で40%になるとは限らない
公式発表の言い方は「既定の設定で、典型的な作業なら40%安い」です。
思考量を最大にしたままにすれば考える量が増え、トークンの節約分は小さくなります。反対に、キャッシュを多く使う長い作業なら、40%より大きく下がる場合もあります。
| あなたの使い方 | 効いてくる部分 | 次にすること |
|---|---|---|
| 短い質問を1回ずつ投げる | 単価の20%が中心。使う量の差は小さい | 20%下がる前提で見積もる |
| 同じ資料や指示を何度も使う | キャッシュ読み出しの60%が大きく効く | キャッシュが効いているかを利用明細で確かめる |
| 長いコーディングを任せる | 単価に加え、少ない手数で終わる分が効く | 同じ作業の費用をOpus 5と並べて測る |
| 思考量を最大に固定している | 考える量が増え、節約分が目減りする | 既定のmediumに戻して出来を比べる |
| 月額プランだけで使う | 単価は関係せず、利用上限の拡大が効く | 上限に届く頻度が減ったかを1週間見る |
どの行に当てはまるかで、期待してよい下がり方が変わります。
Claude Opus 5.5の性能 ベンチマークの読み方
公式発表には、試験ごとの点数が表で載っています。
点数の多くは思考量を最大(max)にした結果で、既定のmediumで使ったときの点数とは条件が違う点に注意が要ります。
エージェント型のコーディングで先頭に立った
コマンド画面で手順の多い作業をこなす力を測るTerminal-Bench 4.0では、66.4%でした。
Fable 5.1は55.8%、Opus 5は52.3%です。手を動かす種類の仕事で、最上位のFable 5.1を上回っています。
出したコードが実際に取り込まれるかを測るFrontierCodeでも、既定のmediumで54.6%を出し、比べた中で最も高い点でした。
知識労働と図表の読み取り
44の職業の実務を模した試験GDPval-AA v2.1では、1846点でした。Fable 5.1は1735点、Opus 5は1708点です。
図表の読み取りを測る試験では、道具を使って89.0%を出しています。
移行ガイドには、図表の読み取りについて「最も低い思考量でも、Opus 5の最も高い思考量より正確に読めた」という記述もあります(筆者訳)。
| 試験(測る力) | Opus 5.5 | Fable 5.1 | Opus 5 |
|---|---|---|---|
| Terminal-Bench 4.0(コマンド画面での作業) | 66.4% | 55.8% | 52.3% |
| FrontierCode v1.1(取り込まれるコード) | 54.4% | 50.3% | 48.0% |
| GDPval-AA v2.1(44職種の実務) | 1846点 | 1735点 | 1708点 |
| OSWorld 2.1(パソコン操作) | 81.8% | 80.7% | 74.0% |
| Humanity’s Last Exam(多分野の推論・道具あり) | 67.7% | 65.6% | 63.6% |
| 図表の読み取り(道具あり) | 89.0% | 88.4% | 83.4% |
どの行でも、Opus 5.5がFable 5.1をわずかに上回るか、大きく引き離しています。
他社の最上位モデルが上回る項目もある
全部で勝っているわけではありません。
公式の表でも、複数のアプリをまたぐ業務の流れを測る試験と、科学研究の作業を測る試験では、比較に載った他社の最上位モデルのほうが高い点でした。
研究用途の作業が中心なら、自分の作業で比べてから決めるのが安全です。
公式自身が点差を当てにしすぎないよう書いている
公式発表には、こんな一文があります。
「この水準の能力になると、ベンチマークの点差は、実際の仕事での差を測る物差しとして当てになりにくくなっている」(筆者訳)。
続けて、社内の利用ではFable 5.1との差は点数が示すより小さい、とも書いています。
点数は選ぶきっかけにとどめ、最後は自分の仕事を1本流して判断してください。
公式の社内試験で見えた使いどころ
点数表とは別に、公式発表には実際の仕事に近い形で試した結果が載っています。
どれもAnthropic自身の試験なので、条件をそろえた第三者の比較とは分けて読む必要があります。
数字を捏造しない報告書づくり
ある会社の四半期の業績報告書を、決算資料が見つけにくい状態のウェブの写しだけを使って書かせる試験がありました。
自動の採点役が、すべての数字と引用を出どころと突き合わせ、1つでも作り話の数字や引用があれば不合格にする条件です。
公式発表によると、Opus 5.5の報告書は18本中16本が基準を満たしました。Fable 5.1とOpus 5は、どの回でも基準を満たせなかったそうです。
移行ガイドも、Opus 5.5は「入力が裏づけない数字や出典を書くことが、Opus 5よりずっと少ない」と書いています(筆者訳)。
調べものをまとめさせる使い方では、ここがいちばん効く変化です。
表計算のモデルと説明資料づくり
架空の会社2社の合併案を分析させ、表計算で財務のモデルを組んでから、経営陣向けの説明資料にまとめさせる試験もありました。
結論は両モデルで同じでしたが、Opus 5.5のモデルのほうが丁寧で、資料も読みやすかったと報告されています。
かかった時間はOpus 5.5が63分、Opus 5が93分で、作る費用は50%少なく済んだとされています。
ウェブアプリの表示を速くする作業
ウェブアプリの全ページで読み込み時間を縮めるよう頼んだ試験では、Opus 5.5は40回中39回で成功しました。
Opus 5は改善の幅が小さく、しかもアプリの動きまで変えてしまったそうです。
直してほしい所だけを直し、ほかを壊さないという性質は、コードを任せる側にとって点数以上に大事な点です。
思考量の既定がmediumになった
Opus 5.5で使い方が最も変わるのは、思考量の設定です。APIの項目名はeffortで、Claude Codeでも同じ段階を選べます。
Opus 5までの既定はhighでしたが、Opus 5.5は一段下のmediumが既定になりました。
5段階の思考量
段階は、low、medium、high、xhigh、maxの5つです。
上に行くほど深く考え、時間も費用も増えます。maxには上限がありません。
mediumでもOpus 5のhighを上回る
移行ガイドは、段階の名前が同じでもモデルが違えば考える量は同じにならない、と注意しています。
そのうえで、Anthropicの試験では「Opus 5.5のmediumは、コーディングと知識労働の評価でOpus 5のhighを上回った」と書いています(筆者訳)。
いくつかのコーディング評価では、lowでもそれに近い点を、ずっと少ない費用で出したそうです。
同じ段階でもOpus 5より多く考える
逆の注意もあります。
同じ段階に設定すると、Opus 5.5はOpus 5より1回あたり多く考える傾向があり、xhighとmaxで特に目立ちます。
Opus 5で使っていたxhighをそのまま持ち込むと、作業が長くなり、出力トークンも増えます。
最大にすれば点が上がるとは限らない
公式発表の数字を並べると、出したコードが取り込まれるかを測る試験で、mediumは54.6%、maxは54.4%でした。
最大にしても点が上がらず、費用だけが増える場面があります。
| 段階 | 向いている仕事 | 気をつけること |
|---|---|---|
| low | 分類・抽出・要約などの定型処理、補助役の作業 | 出来が落ちたらmediumへ戻す |
| medium(既定) | ふだんのコーディングと分析の大半 | まずここで測ってから上下を試す |
| high | 前提の多い難しい分析や設計 | mediumとの差を同じ作業で確かめる |
| xhigh | 測って効果が出た長いコーディング | 作業時間が伸びるので途中経過を見る |
| max | 費用より正確さを優先する仕事 | 上限がなく、点が上がらない場面もある |
移行ガイドも、xhighとmaxは「効果を測って確かめた仕事にとっておく」よう勧めています。
思考量の決め方 測ってから1段ずつ動かす
段階は、感覚で選ぶと費用がふくらみます。
手順に落とすと、次の流れになります。
まずmediumで同じ仕事を流す
ふだん任せている作業を1本選び、mediumのままで流します。
出来と、かかった時間、使ったトークンを記録しておきます。これが比べるときの基準になります。
足りなければ1段だけ上げる
出来に不満があれば、highに1段だけ上げて同じ作業を流します。
いきなりmaxに飛ぶと、どの段階で十分だったのかが分からなくなります。
「短く考えて」と書く前に段階を下げる
移行ガイドは、考える量を減らしたいときは、指示文で抑えるより先に段階を下げるよう勧めています。
段階を下げるほうが、思考と費用と待ち時間を確実に減らせる、という理由です。
| いま起きていること | 疑う所 | 次にすること |
|---|---|---|
| 返事が来るまで長い | 段階が高すぎる | 1段下げて出来を比べる |
| 答えの出来が物足りない | 段階が低すぎる、または指示があいまい | 指示を具体にしてから1段上げる |
| 費用がOpus 5の頃と変わらない | Opus 5のxhighやmaxを持ち込んでいる | mediumに戻して同じ作業を測る |
| 返事が途中で切れる | 最大出力の指定が思考の分を見込んでいない | 出力の上限を思考と返事の合計で取り直す |
| 途中経過が表示されない | ツール呼び出しの間の文が思考ブロックで返っている | 表示の設定を見直し、思考ブロックも画面に出す |
4行目の「途中で切れる」は見落としやすい所です。思考は返事の本文に出なくても、出力の上限には数えられます。
文章の書き方が変わった
Opus 5.5は、書く文章そのものも手直しされています。
Opus 5に寄せられた声で最も多かった点の1つが、伝え方だったそうです。
大事な情報を先に置く
公式発表は「最も大事な情報を先に置き、専門用語や独特な言い回しを使いにくくなった」と書いています(筆者訳)。
作業の報告で、経緯から積み上げずに結論から入るようになった、ということです。
長い作業を任せたあと、何をして何が分かったのかを読む手間が減ります。
渡した書き方のルールに従う
同じ発表では、渡した書き方のルールに従うようになった点も挙げています。
社内の文体ルールや、記事の表記ルールを最初に渡しておく使い方と相性がよい変化です。
画面の見た目を作らせる場合、移行ガイドは「AIっぽさを避けて」と大まかに頼むより、避けたい型を名指しで並べるほうが効くと書いています。
Claudeのアプリでの使い方と利用上限
APIを使わず、Claudeのアプリで使う人も多いはずです。
アプリでは、モデルの選択欄からOpus 5.5を選べます。
5時間ごとの利用上限が引き上げられた
公式発表は、値下げに合わせて「Pro、Max、Team、席ごとの契約のEnterpriseで、5時間ごとの利用上限を引き上げる」と書いています(筆者訳)。
月額プランの人にとっては、単価より、この上限の変化のほうが体感に直結します。
上限のリセットを保存して使える
あわせて、月額プランの利用者には、上限のリセットが1回分配られました。
受け取ったリセットは保存しておき、好きなときに使えます。締め切り前の追い込みのように、上限に届きそうな日のためにとっておくのが向いています。
| 使っている形 | 今回変わったこと | 次にすること |
|---|---|---|
| Pro・Maxの個人プラン | 5時間ごとの上限が上がり、リセット1回分が配られた | 設定画面の利用状況でリセットの有無を確かめる |
| Team | 5時間ごとの上限が上がった | チームで使うモデルの既定を見直す |
| 席ごとの契約のEnterprise | 5時間ごとの上限が上がった | 管理者がモデルの利用方針を更新する |
| APIで直接使う | 単価が20%下がり、思考量の既定がmediumになった | 思考量を明示し、費用を測り直す |
| 大手クラウドの基盤経由で使う | 公開日から提供が始まった | 各基盤のモデル名と利用枠を確かめる |
どの形で使っていても、Opus 5は引き続き選べます。急いで乗り換える必要はなく、比べてから移れば十分です。
APIで使うときに先に直す所
ここからは、APIを組み込んでいる人向けです。
Opus 5のコードのままモデル名だけを変えると、エラーになる指定があります。
モデルIDはclaude-opus-5-5
モデルの指定は「claude-opus-5-5」と書きます。日付の付いた名前を自分で組み立てる必要はありません。
思考を切る指定はエラーになる
Opus 5では、思考量がhigh以下なら思考を切る指定が通りました。
Opus 5.5は常に考えるモデルで、切る指定も、考えるトークンの量を決め打ちする古い指定も、どの段階でもエラーで返されます。
移行ガイドの指示は単純で、思考の指定を消し、待ち時間を縮めたいなら思考量をlowにする、というものです。
ツールの使用を強制する指定もエラーになる
特定のツールを必ず呼ばせる指定(何かしらのツールを必ず使わせる指定も含む)は、Opus 5.5では受け付けられません。
代わりに、ツールの使用はモデルに任せる指定にして、指示文の中で使ってほしいツールを名指しします。呼ばれなかったときに備えて、呼ばれたかどうかを確かめる処理も足しておきます。
JSONを受け取るためだけに強制していたのなら、出力の形を決める機能に置き換えるのが近道です。
パソコン操作の古い指定は通らない
画面を見てパソコンを操作させる機能は、新しい形式(2026年8月版のツール一式)だけを受け付けます。
古い形式のまま送るとエラーになるので、操作の受け渡し部分も含めて書き換えが要ります。
思考ブロックは同じモデルと会話に結び付く
Opus 5.5の思考ブロックは、作ったモデルとその会話に結び付けられます。
2026年8月31日以降に作られたAPIアカウントでは、過去の会話を書き換えたうえで思考ブロックを送り返すとエラーになります。
公式発表は、この仕組みを、モデルの考え方を抜き取ろうとする攻撃への対策と説明しています。会話の履歴は書き換えず、後ろに足していく作りにしておけば問題は起きません。
| Opus 5での書き方 | Opus 5.5での扱い | 直し方 |
|---|---|---|
| 思考を切る指定 | どの段階でもエラー | 指定を消し、速さが要るならlowにする |
| 考えるトークン量の決め打ち | エラー | 思考量の段階で調整する |
| 思考量を指定しない | mediumで動く(Opus 5はhigh) | 段階を明示して測り直す |
| 特定ツールの強制 | エラー | 任せる指定に変え、指示文でツールを名指しする |
| 古いパソコン操作の形式 | エラー | 新しい形式に移し、受け渡し部分も直す |
| 過去の会話を書き換えて再送 | 新しいアカウントではエラー | 履歴は後ろに足すだけの作りにする |
上から3行は、ほぼすべての組み込みで確認が要る項目です。
移り方としては、本番を切り替える前に、同じ入力をOpus 5とOpus 5.5の両方に流して、エラーの有無と出来と費用を並べる方法が手堅いです。
このとき、Opus 5.5側は思考量を必ず明示してください。指定を省くとmediumで動くので、Opus 5のhighと比べる形になり、条件がそろいません。
安全面の新しい仕組み
Opus 5.5は、Opusとして初めて、Fable 5.1と同じ種類の安全装置を付けて出たモデルです。
サイバーと生物の分野に安全装置が付いた
公式発表によると、Opus 5.5はサイバーセキュリティと生物学の能力が高く、それぞれに安全装置が付いています。
自分のコードの不具合を見つけて直す、ふだんの開発の範囲は使えます。一方で、サイバーセキュリティの作業の多くはOpus 4.8に回されます。
生物学の研究開発で安全装置に引っかかる組織向けには、審査を通った組織が使える専用の申請窓口が設けられました。
断られたときは別のモデルに切り替わる
安全装置が働いたとき、Claudeの製品では別のモデルに切り替わって作業が続きます。
APIでは、断られると通常の応答の形で「断った」という理由が返ります。受け取る側は、本文を読む前に止まった理由を確かめ、代わりのモデルで再実行する設定を入れておくと、誤判定で作業が止まる事故を避けられます。
なお、公式発表によると、Opus 5.5も過去のOpusと同じく、データを保持しない契約で使えます。
Opus 5とFable 5.1のどれを選ぶか
選び方は、仕事の重さと費用の重みで決まります。
| あなたの状況 | 選ぶモデル | 理由 |
|---|---|---|
| ふだんのコーディングと分析 | Opus 5.5(medium) | Opus 5のhighを上回り、費用は下がる |
| 大量の定型処理を安く回したい | Opus 5.5(low)から試す | 出来が足りるなら最も安い |
| 最も難しい推論や長期の研究 | Fable 5.1と比べて決める | 点数の差は小さいが単価は倍以上 |
| Opus 5で組んだ仕組みが安定している | 当面Opus 5のまま、並行して検証 | エラーになる指定を直してから移る |
| 思考を切って速さを出していた | Opus 5.5(low)に移す | 思考は切れないが、lowで短くできる |
Fable 5.1の単価は入力10ドル、出力50ドルで、Opus 5.5の2.5倍です。点数の差と単価の差を並べると、大半の仕事ではOpus 5.5から試すのが合理的です。
Claude Opus 5.5のよくある質問
Q. Claude Opus 5.5はいつから使えますか
A. 2026年9月22日の公開日から使えます。Claudeのアプリ、Claude Code、API、大手クラウドの基盤のいずれでも提供されています。
Q. Opus 5より本当に40%安くなりますか
A. 料金表の値下げは20%です。40%は、既定の思考量で典型的な作業をしたときの、作業1回あたりの費用です。
思考量を上げたままなら、下がり幅は小さくなります。
Q. 思考をオフにして費用を抑えられますか
A. できません。Opus 5.5は常に考えるモデルです。
費用と待ち時間を抑えたいときは、思考量をlowにします。
Q. 思考量はどの段階にすればよいですか
A. 既定のmediumから始めます。同じ作業で出来を測り、足りなければhighへ1段ずつ上げます。
xhighとmaxは、効果を確かめた仕事だけに使います。
Q. Opus 5から乗り換えるときにコードの修正は要りますか
A. 思考を切る指定、ツールを強制する指定、古いパソコン操作の形式を使っていれば修正が要ります。どれも使っていなければ、モデル名を変え、思考量を明示するだけで動きます。
まとめ
Claude Opus 5.5は、Opus 5より単価が20%安く、同じ仕事を少ないトークンで終えるので、作業1回あたりの費用が約40%下がるモデルです。
エージェント型のコーディングや知識労働の試験では、最上位のFable 5.1を上回る点も出ています。
使い方で気をつけるのは、思考量の既定がmediumに下がった点です。段階を明示し、mediumで測ってから1段ずつ動かすと、40%の値下げを手元で取りこぼさずに済みます。
APIで組み込んでいる人は、思考を切る指定とツールの強制がエラーになる点を先に直してください。
今日できる点検
読み終えたら、次の表の上から順に確かめてみてください。
| 点検する所 | 見る場所 | 終わったと言える状態 |
|---|---|---|
| 使っているモデル | アプリのモデル選択欄、APIのモデル指定 | Opus 5.5を選んでいる、または残す理由が言える |
| 思考量の段階 | APIの指定、Claude Codeの設定 | 段階を明示し、mediumでの出来を1回測った |
| エラーになる指定 | 思考を切る指定、ツールの強制、古い操作形式 | 3つとも使っていない、または直した |
| 出力の上限 | APIの最大出力の指定 | 思考と返事の合計を見込んだ値にした |
| 利用上限のリセット | アプリの設定画面の利用状況 | 配られたリセットの有無を確かめた |
| 費用の比較 | 利用明細 | 同じ作業のOpus 5との費用を並べた |
1行でも終われば、Opus 5.5の値下げを自分の使い方で確かめる準備は整います。
