結論:複雑な仕事を日常運用するための上位モデル
Claude Opus 5は、最高性能だけを追うモデルというより、複雑なコーディング、PC操作、知識労働を現実的な費用で最後まで進めるための上位モデルです。Claude Maxでは標準モデル、Proでは利用できる最上位モデルになりました。APIのモデル名はclaude-opus-5です。
API価格と提供プラン
| 項目 | 内容 |
|---|---|
| 標準API価格 | 入力100万トークン当たり5ドル、出力100万トークン当たり25ドル |
| Fastモード | 通常のおよそ2.5倍の速度。基本価格の2倍 |
| APIモデル名 | claude-opus-5 |
| Claude Max | 新しい標準モデル |
| Claude Pro | サブスクリプション内で使える最上位モデル |
「半額」は定価が常にFable 5の半分という意味ではありません。AnthropicはCursorBenchで、Fable 5の最高スコアとの差を0.5%以内に抑えつつタスク単価を半分にした結果などを示しています。実際の請求額は、出力量、effort設定、キャッシュ、ツール呼び出し回数で変わります。
Fable 5とどちらを選ぶ?
| 判断軸 | Opus 5 | Fable 5 |
|---|---|---|
| 日常の複雑な実務 | 第一候補。価格と完遂力のバランスを重視 | 絶対的な性能上限が必要な場面 |
| コーディング | 公式CursorBenchでFable 5の最高値に接近 | 高コストを許容して限界性能を狙う |
| PC操作 | 公式OSWorld 2.0ではFable 5最高値を約3分の1強のコストで上回る | 案件ごとに実測して判断 |
| 攻撃的サイバー能力 | AnthropicはMythos 5より低いと説明 | 提供条件と安全制御を含めて確認 |
| 運用方針 | まずOpus 5で評価し、難所だけ上位モデルへ | 費用より失敗回避を優先する限定工程 |
ARC-AGI 3、AutomationBench、OSWorldなどはAnthropicが公表した評価です。自社データ、利用ツール、完了条件が異なれば順位も変わるため、ベンチマークは導入判断の出発点として扱います。
Opus 5が向く3つの用途
短い要約、分類、定型抽出のように安価なモデルで十分な処理までOpus 5へ統一する必要はありません。成功率ではなく、合格した成果物1件当たりの総費用で比較すると選びやすくなります。
API運用で注目したい2つのベータ機能
- 会話途中のツール変更:利用可能なツールを会話中に変更しても、プロンプトキャッシュを維持できる仕組みが追加されました。長時間エージェントの再計算を抑えやすくなります。
- 安全分類器によるフォールバック:分類器が要求をブロックした場合、APIでは別モデルへ自動的に振り替える機能を任意で有効化できます。応答に使われた実モデルをログへ残す設計が必要です。
Opus 5は、ソースコードの脆弱性検出を許可する一方、バイナリの脆弱性スキャン、侵入テスト、エクスプロイト生成をブロックします。目的が正当でも対象や手法によって処理経路が変わります。
導入時の5ステップ
- 既存モデルで失敗しやすい実務タスクを10件程度選ぶ。
- 完了条件、品質、再作業時間、タスク単価を記録する。
- Opus 5のeffort設定を変えて同じタスクを実行する。
- Fastモードは速度の価値が価格差を上回る工程だけで試す。
- モデル名、フォールバック、ツール呼び出し、最終承認をログに残す。
確認した公式情報
よくある質問
Claude Opus 5はいくらですか?
APIの標準価格は入力100万トークン当たり5ドル、出力100万トークン当たり25ドルです。Fastモードは基本価格の2倍です。
Fable 5より常に半額ですか?
いいえ。公式の半額という説明は、一部ベンチマークで近い性能を達成した際のタスク単価を指します。実際の費用は出力量や設定で変わります。
Claude Proでも利用できますか?
はい。AnthropicはOpus 5をProで利用できる最上位モデルと案内しています。