2026年7月24日、AnthropicはClaude Opus 5を発表しました。最上位モデルであるFable 5に迫る性能を、Opus 4.8と同じ料金(入力$5・出力$25/100万トークン)で提供するモデルです。
「Opus 4.8から乗り換えるべきか」「Fable 5との違いがわからない」「effortやthinkingの設定はどうすればいいのか」、こうした疑問を持つ方は多いのではないでしょうか。
本記事では、Claude Opus 5の基本スペックからベンチマーク結果、料金体系、Fable 5・Opus 4.8との比較、effort設定の使い分け、Opus 4.8からの移行手順まで、2026年7月時点の最新情報を網羅的に解説します。
\ ChatGPTもClaudeもGeminiも使える! /
Claude Opus 5とは?
Claude Opus 5は、AI安全性企業Anthropicが2026年7月24日にリリースした新しい主力モデルです。Claudeシリーズの中で「上位モデル」に位置づけられ、最上位のFable 5に迫る性能をFable 5の半額で提供します。
Claude Opus 5の基本スペックは以下のとおりです。
| 項目 | 仕様 |
|---|---|
| モデルID | claude-opus-5 |
| API料金(100万トークンあたり) | 入力$5・出力$25 |
| コンテキストウィンドウ | 1Mトークン(約55万語) |
| 最大出力トークン | 128K |
| 知識カットオフ | 2026年5月 |
| thinking(思考モード) | デフォルトでオン |
Opus 4.8と同じ料金でありながら、主要ベンチマークでOpus 4.8の2倍以上のスコアを記録しています。Anthropicは「毎日使えるように設計した」と述べており、コスト対性能の最適解を狙ったモデルといえます。
Claudeシリーズの中での位置づけ
2026年7月時点のClaudeの一般提供モデルは、以下の4階層で構成されています。
| モデル | 位置づけ | API料金(入力/出力) |
|---|---|---|
| Fable 5 | 最上位 | $10/$50 |
| Opus 5 | 上位・主力 | $5/$25 |
| Sonnet 5 | 標準 | $2/$10(導入価格) |
| Haiku 4.5 | 軽量・高速 | $1/$5 |
Opus 5は、Fable 5の半額で「フロンティア級の知能に迫る」ことを目指したモデルです。日常的な業務で最も多く使われるであろう「コスト対性能のスイートスポット」として設計されています。
一方で、Sonnet 5は2026年9月1日に導入価格($2/$10)から標準価格($3/$15)に値上げが予定されています。モデル選定の際はこの点も考慮しておきましょう。
【関連記事】
Claude Fable 5とは?使い方や性能・料金・Mythos 5との違い
Claude Sonnet 5とは?Anthropic最新モデルの性能・料金・使い方を徹底解説
Claude Opus 5の性能・ベンチマーク
Claude Opus 5は、複数の主要ベンチマークでOpus 4.8を大幅に上回り、一部の指標ではFable 5をも超える結果を出しています。
公式ベンチマーク:Opus 4.8比で2倍超、Fable 5に僅差
Anthropicが公表した主要ベンチマーク結果を以下にまとめます(2026年7月25日時点)。
| ベンチマーク | 評価対象 | Opus 5 | Fable 5 | Opus 4.8 | GPT-5.6 Sol |
|---|---|---|---|---|---|
| Frontier-Bench v0.1 | エージェント型ターミナル操作 | 43.3% | 33.7% | 21.1% | 34.4% |
| ARC-AGI-3 | 新規問題解決 | 30.2% | — | 1.5% | 7.8% |
| OSWorld 2.0 | コンピュータ操作 | 70.6% | 66.1% | 55.7% | 62.6% |
| GDPval-AA v2 | ナレッジワーク | 1861 | 1747 | 1593 | 1736 |
| AutomationBench | 業務ワークフロー | 26.0% | 17.4% | 17.0% | 18.1% |
| BrowseComp | エージェント型検索 | 90.8% | 87.4% | 84.3% | 90.4% |
| DeepSWE v1.1 | エージェント型コーディング | 68.8% | 69.7% | 59.0% | 72.7% |
| Humanity’s Last Exam(ツールあり) | 学際推論 | 64.7% | 63.9% | 57.9% | — |
特に注目すべきポイントは以下の3つです。
- Frontier-Bench v0.1:Opus 4.8の21.1%から43.3%へ倍増。Fable 5(33.7%)やGPT-5.6 Sol(34.4%)をも上回る
- ARC-AGI-3:次点モデル(GPT-5.6 Sol 7.8%)の約3倍となる30.2%を記録
- OSWorld 2.0:Fable 5(66.1%)を4.5ポイント上回る70.6%。コンピュータ操作タスクでの強さが際立つ
Artificial Analysis Intelligence Index(Max Effort条件)では、Opus 5が61、Fable 5が60、GPT-5.6 Solが59と、僅差です。
弱点:一部ベンチマークでは他モデルに劣る
Opus 5は「全勝」ではありません。以下の領域では他モデルに劣る結果が出ています。
- HealthBench Professional:Opus 5は59.8%で、GPT-5.6 Sol(60.5%)やMythos 5(66.0%)を下回る
- DeepSWE v1.1:GPT-5.6 Sol(72.7%)がOpus 5(68.8%)を上回る
- Legal Agent Benchmark:Fable 5(13.3%)がOpus 5(11.7%)をわずかに上回る
また、サイバーセキュリティ関連の評価ではMythos 5が高い評価を受けています。Mythos 5はFable 5と同じ基盤モデルの別構成で、サイバー・バイオ研究向けに限定提供されているモデルです。ベンチマーク結果はあくまで指標の一つであり、自社のユースケースに合わせた検証が重要です。
Claude Opus 5の料金
Claude Opus 5のAPI料金は、Opus 4.8と同額に据え置かれました。Fable 5のちょうど半額という価格設定は、コスト対性能を重視するユーザーにとって大きな魅力です。
APIの料金
Claudeシリーズの料金比較は以下のとおりです(100万トークンあたり)。
| モデル | 入力 | 出力 | Opus 5比 |
|---|---|---|---|
| Fable 5 | $10 | $50 | 2倍 |
| Opus 5 | $5 | $25 | 基準 |
| Opus 4.8 | $5 | $25 | 同額 |
| Sonnet 5(導入価格) | $2 | $10 | 40% |
| Sonnet 5(9/1以降) | $3 | $15 | 60% |
Opus 5はFable 5と比べて入力・出力ともに半額です。同じ料金でOpus 4.8から大幅な性能向上が得られるため、「値段を変えずに一段上の性能を手に入れる」世代交代モデルといえます。
コスト削減手段として、以下の仕組みも活用できます。
- プロンプトキャッシュ:キャッシュヒット時に入力トークンが90%割引
- バッチAPI:リアルタイム性が不要な処理で50%割引
effortとfast modeがコストに与える影響
API料金は「トークン単価×消費トークン数」で決まるため、effort設定によって実際の請求額は大きく変動します。
- effort low:thinking(思考プロセス)のトークン消費を最小化。単純なタスクなら大幅にコスト削減可能
- effort max:最も深い推論を行うため、thinkingトークンが大量に消費される。フロンティア級の難問向け
また、fast mode(研究プレビュー)は、応答速度を約2.5倍に高速化する代わりに、料金が入力$10・出力$50(標準の2倍)です。レイテンシが重要なリアルタイムアプリケーションでの利用を想定した機能です。
つまり、Opus 5の「入力$5・出力$25」はあくまで基本単価であり、effortの段階やfast modeの利用により、実際のコストは変動します。コスト管理の観点では、タスクの難易度に応じてeffortを適切に設定することが重要です。
Claude Opus 5の使い方・始め方
Claude Opus 5は、有料プラン・Claude Code・APIの3つの経路で利用を開始できます。
有料プランで使う
Claude Opus 5のプラン別利用可否は以下のとおりです。
| プラン | 月額 | Opus 5の利用 | 備考 |
|---|---|---|---|
| Free | 無料 | ❌ 利用不可 | Haiku 4.5とSonnet 5のみ |
| Pro | $20 | ✅ 選択可能 | プラン使用量枠内で利用可能 |
| Max | $100/$200 | ✅ デフォルト | 標準モデルがOpus 5に切り替わる |
| Team | 要問い合わせ | ✅ 利用可能 | シート種別により上限が異なる |
| Enterprise | 要問い合わせ | ✅ 利用可能 | シート種別により上限が異なる |
Maxプランでは、Opus 5がデフォルトモデルとして設定されています。Proプランではモデル選択画面からOpus 5を明示的に選ぶ必要があります。無料プランでは利用できません。
Claude CodeとClaude Coworkで使う
Claude CodeでOpus 5を利用するには、v2.1.219以降へのアップデートが必要です。モデル切り替えは以下の方法で行えます。
- セッション中:
/model opus - 起動時:
claude --model opus - 環境変数:
export ANTHROPIC_MODEL=claude-opus-5 - プロジェクト設定(
.claude/settings.json):{ "model": "opus" }
MaxプランやTeam Premiumプランでは、Claude CodeのデフォルトモデルがすでにOpus 5に切り替わっています。ProプランやTeam Standardプランでは、デフォルトがSonnet 5のままのため、/model opusで明示的に切り替えてください。
Claude Coworkでも同様にOpus 5を利用可能です。
APIで使う
APIでの利用は、モデルIDをclaude-opus-5に指定するだけです。Opus 4.8からの移行はモデルIDの1行変更で完了します。
# Before
model = "claude-opus-4-8"
# After
model = "claude-opus-5"
effort設定を含めたAPI呼び出しの例は以下のとおりです。
import anthropic
client = anthropic.Anthropic()
response = client.messages.create(
model="claude-opus-5",
max_tokens=4096,
messages=[
{"role": "user", "content": "この契約書の解約条項のリスクを3点で要約して"}
],
output_config={"effort": "medium"},
)
クラウド経由で利用する場合のモデルIDは以下のとおりです。
- AWS Bedrock:
anthropic.claude-opus-5 - Google Cloud Vertex AI:
claude-opus-5 - Microsoft Foundry:対応済み
effortとthinkingの設定
Opus 5の実務運用で最も重要なポイントが、effort(思考量の調整)とthinking(思考モード)の設定です。Opus 4.8から仕様が変わっているため、移行時には必ず確認してください。
effortの段の選び方
effortは5段階で、タスクの難易度に応じて思考量を調整します。
| effort | 用途 | トークン消費 | 推奨タスク例 |
|---|---|---|---|
| low | 即答系 | 最小 | 簡単な分類、定型Q&A、サブエージェントの下請け処理 |
| medium | バランス型 | 中程度 | 速度・コスト・性能のバランスが必要なエージェント処理 |
| high(デフォルト) | 汎用 | 標準 | 複雑な推論、難しいコーディング、エージェント的タスク全般 |
| xhigh | 長時間探索 | 高め | 30分超の自律的なコーディング・調査 |
| max | 最大精度 | 最大 | フロンティア級の難問、最も深い推論 |
運用の指針としては、まずデフォルトのhighで試し、十分な品質が得られるならmediumやlowに下げるのが効率的です。本当に難しい問題に限ってxhighやmaxを使いましょう。
Claude Codeでのeffort設定は以下のコマンドで行えます。
/effort xhigh:直接指定/effort:インタラクティブに選択claude --effort medium:起動時に指定/effort auto:デフォルトに戻す
thinkingがデフォルトでオンになった影響
Opus 5では、thinking(内部での思考プロセス)がデフォルトでオンです。移行時には、thinkingとeffortの扱いを確認してください。この変更により、以下の影響があります。
- max_tokensの再見積もりが必要
max_tokensは「思考トークン+応答テキスト」の合計に対するハード制限です。thinkingオフを前提に設定していた値では、思考トークン分が不足してエラーになる可能性があります。 - thinkingの無効化可否は利用環境によって異なる
thinkingの無効化可否は、利用環境によって異なります。既存のコードでthinking設定を明示している場合は、挙動を確認してください。
Fable 5・Opus 4.8との違い
Claude Opus 5を導入する際に最も気になるのが、Fable 5やOpus 4.8との違いでしょう。ここではスペックの比較と使い分けの判断軸を整理します。
スペックの比較
| 項目 | Fable 5 | Opus 5 | Opus 4.8 |
|---|---|---|---|
| 料金(入力/出力) | $10/$50 | $5/$25 | $5/$25 |
| コンテキスト | 1Mトークン | 1Mトークン | 1Mトークン |
| 最大出力 | 128K | 128K | 128K |
| 知識カットオフ | 2026年1月 | 2026年5月 | 2026年1月 |
| Frontier-Bench v0.1 | 33.7% | 43.3% | 21.1% |
| ARC-AGI-3 | — | 30.2% | 1.5% |
| OSWorld 2.0 | 66.1% | 70.6% | 55.7% |
| GDPval-AA v2 | 1747 | 1861 | 1593 |
| Intelligence Index | 60 | 61 | 56 |
| thinking既定 | — | オン | オフ |
Opus 5はOpus 4.8と同額でありながら、主要ベンチマークで大幅に性能が向上しています。Fable 5と比較しても、Frontier-BenchやOSWorldなどの指標ではOpus 5が上回っており、総合評価でも僅差です。
なお、Anthropicの公式System Cardでは「Claude Opus 5 is not more capable overall than Claude Fable 5」と記載されており、Fable 5が依然として最も高い総合能力を持つモデルとして位置づけられています。一部のベンチマークでOpus 5が上回る指標があるものの、総合的にはFable 5が上位モデルです。
GPT-5.6 Solとの比較では、Opus 5はFrontier-Bench(43.3% vs 34.4%)やARC-AGI-3(30.2% vs 7.8%)で大きくリードする一方、DeepSWE v1.1(68.8% vs 72.7%)ではSolが上回るなど、得意領域が異なります。
使い分けの判断軸
3モデルの使い分けは、以下の判断フローで整理できます。
- 難題・長期自律タスク → Fable 5:数日がかりの自律的な作業、最高精度が求められるフロンティア級の課題にはFable 5が最適。ただしコストは2倍
- コスト対性能の最適解 → Opus 5:日常業務で最も多く使うモデル。Fable 5に迫る性能を半額で利用でき、エージェント型タスクやコーディングに強い
- 量を回す定型作業 → Sonnet 5:大量のリクエストを処理する定型作業にはSonnet 5が適している。Opus 5の40%のコストで運用可能
実運用では、「司令塔にFable 5、実働部隊にOpus 5やSonnet 5」というオーケストレーター構成も有効です。タスクの難易度に応じてモデルを使い分けることで、品質とコストのバランスを最適化できます。
Opus 4.8からの移行
Opus 4.8からOpus 5への移行は比較的シンプルですが、いくつかの重要な確認ポイントがあります。
モデルIDを書き換える
APIでの移行は、モデルIDを1行変更するだけです。
| 環境 | 旧モデルID | 新モデルID |
|---|---|---|
| Anthropic API | claude-opus-4-8 | claude-opus-5 |
| AWS Bedrock | anthropic.claude-opus-4-8 | anthropic.claude-opus-5 |
| Google Cloud Vertex AI | claude-opus-4-8 | claude-opus-5 |
なお、Claude Opus 4.1は2026年8月5日に提供終了(リタイア)が予定されています。旧モデルを指定しているシステムは早めに棚卸ししておきましょう。
プロンプトから「検証してください」系の指示を外す
Opus 5は自己検証能力が大幅に向上しています。Anthropicは「自分の作業を検証するようになった」と説明しており、Opus 4.8向けに追加していた以下のようなプロンプトは不要になりました。
- 「もう一度確認してください」
- 「必ず最終確認を入れてください」
- 「サブエージェントで検証してください」
これらの指示を残すと、Opus 5が過剰な検証ループに入り、冗長な応答やトークンの無駄遣いにつながります。移行時にはプロンプトの棚卸しを行い、検証系の指示を削除しましょう。
移行の推奨手順をまとめると、以下の3ステップです。
- モデルIDの書き換え:claude-opus-4-8 → claude-opus-5
- thinkingデフォルトオンの影響確認:max_tokensの再見積もり、effortとthinkingの組み合わせ確認
- プロンプトの棚卸し:検証系指示の削除、不要になった回避策の整理
本番投入前に検証環境でユースケースを確認してから切り替えることを推奨します。
Claude Opus 5の注意点・制限
Claude Opus 5を利用する際に押さえておくべき制限事項を整理します。
安全分類器による自動モデル切り替え
Opus 5が利用可能なすべてのプラットフォーム(Claude.ai、Claude Code、Claude Cowork、Claude Mobile、Claude Desktop、Claude Designなど)では、安全分類器がリクエストを拒否した場合、別モデルに自動で切り替わる仕組みがデフォルトで有効です。
なお、API経由では自動フォールバックはデフォルトでは無効であり、ベータヘッダー(server-side-fallback-2026-07-01)を付与してオプトインする必要があります。
ユーザーから見ると「Opus 5を選んだのに、別モデルが応答している」という状況が起こりえます。ログやガバナンス設計では、「常にOpus 5が使われるとは限らない」前提で設計することが重要です。
また、API経由では以下の制限があります。
- Webフェッチツール(AIが指定URLの中身を取得する機能):Opus 5では利用不可
- Priority Tier(混雑時の優先処理):Opus 5では利用不可
判断の一貫性は改善したと報告されている
Anthropicは、Opus 5を「これまでで最も整合性の取れた(アライメントされた)モデル」と説明しています。行動監査での評価は過去最高水準です。
ただし、一部の外部評価では、特定のタスクでハルシネーション率がOpus 4.8より上昇したという報告もあります。また、現場のフィードバックとして「コーディングではOpus 4.8のほうが安定する」「長い文脈で話題を見失うことがある」といった声も見られます。
ベンチマークの数値は発表側が有利な指標を選んで提示する傾向があるため、自社の業務データ・実ユースケースでの検証が最も重要です。
Claude Opus 5に関してよくある質問
無料プランでClaude Opus 5は使えますか?
無料プランではClaude Opus 5を利用できません。無料プランで使えるモデルはHaiku 4.5とSonnet 5のみです。
Opus 5を利用するには、以下のいずれかが必要です。
- Pro(月額$20):モデル選択画面からOpus 5を選択
- Max(月額$100/$200):デフォルトモデルとしてOpus 5が利用可能
- Team / Enterprise:シート種別に応じて利用可能
- API(従量課金):入力$5・出力$25でフルアクセス
Opus 4.8から乗り換えるべきですか?
同じ料金で性能が大幅に向上しているため、基本的には乗り換えを推奨します。主要ベンチマークでOpus 4.8の2倍以上のスコアを記録しており、エージェント型タスクやナレッジワークでの改善は顕著です。
ただし、以下の点に注意が必要です。
- thinkingがデフォルトでオンのため、
max_tokensの再見積もりが必要 - effortとthinkingの組み合わせ条件が利用環境によって異なるため、既存コードの確認が必要
- 検証系プロンプトの棚卸しが必要
段階的な移行(検証環境→一部ユースケース→全面切り替え)を推奨します。
Claude Fable 5とOpus 5、どちらを使うべきですか?
用途によって使い分けるのが最適です。
- Fable 5が適しているケース:数日がかりの長期自律タスク、最高精度が求められるフロンティア級の課題、予算に余裕がある場合
- Opus 5が適しているケース:日常業務のコスト対性能を重視する場合、エージェント型タスクやコーディング、定常的なAPI利用
Intelligence Indexでは両者の差はわずか1ポイント(Opus 5:61、Fable 5:60)ですが、Anthropicの公式見解ではFable 5が総合能力で上位に位置づけられています。多くの日常タスクではOpus 5でも十分な結果が得られるため、「司令塔にFable 5、実働部隊にOpus 5」というオーケストレーター構成で両者を組み合わせる運用も有効です。
Claude Opus 5は「同じ料金で一段上がった」世代交代モデル
Claude Opus 5の核心的な価値は、Fable 5に迫る性能をFable 5の半額・Opus 4.8と同額で提供するという点にあります。
本記事のポイントを整理します。
- 性能:Frontier-Bench v0.1でOpus 4.8比2倍超、ARC-AGI-3で次点の3倍、Intelligence IndexでFable 5と僅差
- 料金:入力$5・出力$25でOpus 4.8から据え置き。Fable 5の半額
- 移行:モデルIDの1行変更で完了。ただしthinkingデフォルトオンの影響確認とプロンプト棚卸しが必要
- 使い分け:難題はFable 5、日常業務はOpus 5、定型作業はSonnet 5
まずは検証環境でeffort highから試し、自社のユースケースに合うかを確認してみてください。Opus 4.8ユーザーにとっては、同じコストで一段上の性能を手に入れられる、見送る理由の少ないアップグレードです。


