Anthropic「Claude Opus 5」提供開始――Fable 5に迫る性能を半額で、日本時間7月25日に登場
※本記事は2026/07/25時点での情報を基にしており、閲覧時点では内容や状況が変わっている可能性があります。
Anthropicは2026年7月24日(米国時間)、新たなAIモデル「Claude Opus 5」を発表し、同日から提供を開始した。発表日時は日本時間7月25日未明にあたる。発表の中心は価格性能比である。最上位モデルのClaude Fable 5に迫る性能を、前世代のClaude Opus 4.8と同額で提供。Fable 5と比べれば、APIの標準料金は半額になる。
Claudeの有料プラン・Claude Code・Claude APIで利用できる。Claude Maxでは既定モデルとなり、Claude Proでは選択できる最上位モデルに位置づけられた。
Claude Opus 5の提供内容――有料プランとAPIで同日開始
Anthropicは公式発表で、Opus 5を「思慮深く、自発的に行動するモデル」と位置づけた。日常的な利用を想定し、他のモデルより効率的に動くよう設計したと説明している。
公式のモデル選択指針では、複雑なエージェント型コーディングや企業業務ではOpus 5を最初の候補としている。一方、利用可能な最高水準の能力が必要な処理にはFable 5を案内している。
主要プラットフォームで同日提供
Opus 5は発表と同日に、Anthropicが案内する全プラットフォームで提供が始まった。日本向けに別の発表日を設けたものではない。
利用経路はClaude API・Amazon Bedrock・Claude on Google Cloud・Microsoft Foundryである。Claude APIのモデルIDには claude-opus-5 を使い、AWS経由では anthropic.claude-opus-5 となる。
前世代のClaude Opus 4.8も、これらのプラットフォームで引き続き提供される。既存の処理を直ちに切り替える必要はない。
価格はOpus 4.8から据え置き
API料金は入力100万トークンあたり5ドル・出力100万トークンあたり25ドルで、Opus 4.8と同額である。上位のFable 5は入力10ドル・出力50ドルであり、Opus 5はその半額にあたる。
| モデル | 入力(100万トークン) | 出力(100万トークン) |
|---|---|---|
| Claude Opus 5 | 5ドル | 25ドル |
| Claude Opus 4.8 | 5ドル | 25ドル |
| Claude Fable 5 | 10ドル | 50ドル |
| Claude Opus 5(Fast mode) | 10ドル | 50ドル |
プランごとの位置づけも変わった。米国向け月払いでは、月額100ドルからのClaude MaxでOpus 5が既定のモデルとなる。月額20ドルのClaude Proでは選択できるモデルのうち最も性能の高いものになる。地域によって現地通貨表示や税の扱いは異なる。
Fast modeはClaude APIのみのリサーチプレビュー
通常の約2.5倍の速度で応答する「Fast mode」も用意された。料金は通常の2倍で、入力10ドル・出力50ドルとなる。
ただし、Fast modeの提供範囲は限られる。公開日時点ではClaude APIだけのリサーチプレビューであり、Amazon Bedrock・Google Cloud・Microsoft Foundryでは利用できない。Claude Codeでは使用クレジットを通じて利用できる。
ベンチマークで示された性能
Anthropicは、コーディングと知識労働の評価でOpus 5が最高水準に達したと説明している。以下は同社のシステムカードと公式発表に基づくベンダー公表値である。
コーディング評価での位置づけ
ターミナル上で科学・工学を含む実務的な課題を解く「Frontier-Bench v0.1」について、システムカードの能力評価一覧はOpus 5を43.3%としている。GPT-5.6 Solは37.5%、Fable 5は33.7%、Opus 4.8は18.7%である。
| モデル | Frontier-Bench v0.1 |
|---|---|
| Claude Opus 5 | 43.3% |
| GPT-5.6 Sol | 37.5% |
| Claude Fable 5 | 33.7% |
| Claude Opus 4.8 | 18.7% |
この比較はmini-SWE-agentハーネスとGKE環境を使い、各タスク5試行の平均報酬を集計したものだ。Opus 5とFable 5では、安全性分類器が拒否した際にOpus 4.8へフォールバックしている。システムカードの詳細節は、Opus 5の最良値としてxhigh effortの44.4%も示す一方、max effortは約43%としている。
なお、この評価には複数の数値が並存している点に注意が必要である。Anthropicの発表ページに掲載された図や、それを引用した報道では、GPT-5.6 Solを34.4%・Opus 4.8を21.1%とする値も流通している。本記事の表は、システムカードの能力評価一覧に掲載された同一ハーネスの比較値を採った。
「CursorBench 3.2」では、推論量を最大に設定した状態でFable 5の最高スコアとの差を0.5%以内に抑えつつ、タスクあたりのコストを半分に削減したとしている。high・xhigh・maxの各設定でも、同じコストで比べた性能は他のモデルを上回ったという。
知識労働とコンピュータ操作の評価
未知の課題を解く「ARC-AGI 3」では、Opus 5が次点モデルの3倍のスコアを記録した。業務タスクを最初から最後まで完了できるか測る「Zapier AutomationBench」では、同じタスク単価で比較した合格率が次点モデルの約1.5倍に到達。最も低いeffort設定でも、他のモデルより多くのタスクに合格したという。コンピュータ操作を測る「OSWorld 2.0」では、Fable 5の最高成績をコストの3分の1強で上回った。
さらに、科学分野の改善も公表されている。分光データから分子構造を推定するAnthropicの社内評価では、Opus 4.8を10.2ポイント上回った。タンパク質配列の変異が機能に与える影響を予測する評価では、7.7ポイント上回った。
第三者機関の評価
Artificial Analysisの2026年7月24日付の評価では、Opus 5のmax設定がIntelligence Indexで61を記録した。Fable 5の60を1ポイント上回るが、同機関は実質的に同水準と説明している。
コーディングでは、Opus 5のxhigh設定とClaude Codeの組み合わせがCoding Agent Indexで共同首位となった。エージェント型の知識労働では、GDPval-AA v2とAA-Briefcaseで公開時点の最高値を記録している。これらの順位やスコアは更新される可能性がある。
仕様変更――思考の既定有効化とeffortの5段階
Opus 5では、モデル性能だけでなくAPIの挙動にも変更が入った。Opus 4.8からの移行では、コードを変えなくても結果が変わる箇所がある。
100万トークンのコンテキストと2026年5月のカットオフ
コンテキストウィンドウは既定値・最大値ともに100万トークンで、小さいコンテキストの変種はない。同期Messages APIでの最大出力は12万8000トークンとなる。Anthropicのモデル一覧によれば、信頼できる知識と学習データのカットオフはいずれも2026年5月である。
思考が既定で有効になり、effortが5段階に
Opus 4.8では、thinking を指定しないAPIリクエストは思考なしで処理されていた。Opus 5では既定が変わり、モデルが各ターンで思考の要否と量を判断する。
推論量を制御する effort は、low・medium・high・xhigh・max の5段階で、既定は high である。Anthropicは、Opus 5が追加のeffortを結果の改善へ変換する度合いは従来のOpusより高いと説明している。
移行時に注意が必要な破壊的変更もある。effortが xhigh または max の状態で thinking: {"type": "disabled"} を指定すると、400エラーが返る。思考を無効にしたまま使う場合はeffortを high 以下にする。effortを維持する場合は thinking フィールドを外す必要がある。
既存プロンプトの挙動が変わる点
公式ガイドは、Opus 4.8向けの既存プロンプトでも良好に動作するとした上で、いくつかの挙動差を挙げている。ユーザー向けの応答や生成文書は長くなる傾向がある。effortを下げても表示される応答が確実に短くなるわけではないため、必要な長さはプロンプトで明示するよう案内している。
もう1点は検証の扱いである。Opus 5は指示がなくても自らの作業を検証する。「最後に検証ステップを入れる」「サブエージェントで検証する」といった旧モデル向けの指示は過剰な検証を招くため、削除が推奨されている。マルチエージェント構成ではサブエージェントへ委任しやすくなっており、作業範囲や委任条件の明示も推奨される。
このほか、キャッシュ可能なプロンプトの最小長がOpus 4.8の1024トークンから512トークンへ短縮された。会話中にツールを追加・削除してもプロンプトキャッシュを維持できる「Mid-conversation tool changes」もベータで提供される。安全性分類器の拒否時にAnthropic推奨モデルへ振り分ける fallbacks の "default" モードもベータである。
安全性評価と、同社が公表した弱点
整合性は同社の評価で過去最高
配備前テストの自動行動監査において、AnthropicはOpus 5をこれまでで最も整合性の高いモデルだと評価した。Claudeの憲法への順守度でOpus 4.8・Sonnet 5・Fable 5を上回ったとしている。欺瞞的な振る舞いの発生率が最も低く、取り返しのつきにくい副作用を伴う無謀な行動も最も少ないという。全体の不整合行動スコアは2.3で、同社の近年モデルでは最も低い。
サイバー分野の扱いとフォールバック
Opus 5はサイバー関連タスクの訓練を意図的に避けているが、汎用能力の向上に伴い、この領域の性能も伸びた。脆弱性を発見する能力はMythos 5に近づいた一方、それを悪用するエクスプロイト開発能力はMythos 5を大きく下回るとされる。
安全対策の設計も公表されている。ソースコードからの脆弱性発見は許可する一方、コンパイル済みバイナリを対象とした脆弱性スキャン・ペネトレーションテスト・エクスプロイト生成は分類器がブロックする。分類器が介入する頻度はFable 5と比べて約85%減る見込みである。Claude.ai・Claude Code・Claude Coworkでフラグが立ったリクエストは、既定でOpus 4.8へフォールバックする。
生物学分野ではOpus 4.8と同様のセーフガードを備えた。Anthropicは、一般提供モデルの中で科学研究に最も適したモデルになったと説明している。今回の公開に合わせ、Fable 5でブロックされる生物学関連のリクエストはOpus 4.8ではなくOpus 5へ振り分けられる。
正答割合と誤答割合が同時に上昇
正確性については、改善と悪化が同時に報告された。Web検索や知識ベースを使わずに41分野の事実問題へ答える「AA-Omniscience」では、正答割合がOpus 4.8の約60%から約71%へ上がった。一方、誤答割合も約17%から約22%へ上昇した。
この評価では、各回答を正答・誤答・棄権の3区分で採点する。棄権は誤答に含まれず、正答数から誤答数を引いた値がネットスコアになる。
システムカードはOpus 5の正確性が全体として向上したとする一方、内部・外部の試用では、根拠のない主張や捏造データを自信ありげに示した後で撤回する例が報告されたとしている。数値の裏取りが必要な用途では、モデルの世代が上がっても確認工程が欠かせない。
有料プランでの位置づけと、6月以降で4モデル目の公開
ProとMaxでの位置づけの変化
今回の発表で、米国向け月払いが20ドルのClaude Proでも、選択できる最上位モデルがOpus 5になった。MaxではOpus 5が既定モデルとなる。
Anthropicのモデル選択指針は、複雑なエージェント型コーディングや企業業務ではOpus 5を最初の候補にしている。最高水準の能力が必要な処理にはFable 5を案内する。Fable 5の公式ページも、野心的で長時間・非同期の作業に適したモデルと位置づけている。
短い間隔で続くモデル公開
Anthropicは6月9日にFable 5と限定提供のMythos 5を発表し、6月30日にSonnet 5を公開した。7月24日のOpus 5は、6月9日以降に発表された4つ目のモデルとなる。ただし、Mythos 5は限定提供のモデルである。一般に提供されるモデルだけを数えれば、Opus 5は3つ目にあたるものだ。
短い間隔で公開が続けば、モデルの選定や移行の判断も繰り返し発生する。今回のOpus 5でも、思考の既定有効化とeffortの制約は既存実装に影響し得るだろう。
価格を据え置いたまま性能を引き上げる今回の打ち出しは、モデル名や単純な最高値だけでなく、タスクあたりのコストと成功率を、同じ条件で比べる必要性を示している。
※出典:Introducing Claude Opus 5(Anthropic) / Claude Opus 5 System Card(Anthropic) / What’s new in Claude Opus 5(Claude Platform Docs) / Models overview(Claude Platform Docs) / Plans & Pricing(Claude) / Claude Fable(Anthropic) / Claude Fable 5 and Claude Mythos 5(Anthropic) / Introducing Claude Sonnet 5(Anthropic) / Opus 5: Fable 5 level intelligence at a lower cost per task(Artificial Analysis)