Fable 5級の知能を、据え置きの値段で回す──Claude Opus 5が「長時間エージェントのOpus」を作り直した

Anthropicが7月24日にClaude Opus 5を公開。据え置きの$5/$25で公開最上位Fable 5に迫る性能を打ち出し、Claude Codeの既定Opusも置き換え。料金・ベンチ・エージェント運用の変化と留保点を整理します。

シェア
Fable 5級の知能を、据え置きの値段で回す──Claude Opus 5が「長時間エージェントのOpus」を作り直した

Anthropic は2026年7月24日、Opus ティアの新モデル「Claude Opus 5」を公開しました。同社が「最上位の Fable 5 に迫る知能を、その半額で」と位置づける一手で、Claude Max では既定モデルに、Claude Pro では選べる中で最上位に据えられます。Claude Code v2.1.219 でも既定の Opus として組み込まれ、コーディングエージェントを長く走らせる開発者にとっては「毎日回す頭脳」が静かに置き換わった形です。ここでは、料金・実力・運用上の変化を、開発現場の目線で整理します。

値札は上げずに、狙うのは「Fableの半額」

Opus 5 の標準料金は、置き換え対象の Opus 4.8 と同じ入力100万トークンあたり$5・出力$25です。値上げなしで性能だけを引き上げた、という打ち出しになります。ポイントは、この価格帯で公開最上位の Fable 5($10/$50)に肉薄する点で、Anthropic は「フロンティアに近い知能を半額で」と説明しています。加えて、およそ2.5倍速で動くFast モードが用意され、こちらは標準の倍額($10/$50相当)です。

モデル入力 / 100万トークン出力 / 100万トークン位置づけ
Claude Opus 5(標準)$5$25新・既定の Opus
Claude Opus 5(Fast)$10$50約2.5倍速・倍額
Claude Opus 4.8$5$25置き換え対象
Claude Fable 5$10$50公開最上位

提供面は Claude.ai・Claude Code・Claude Cowork・Claude API に広がります。API 上のモデル名は claude-opus-5 で、Claude Code の claude-api スキルも既定を Opus 5 に更新し、Opus 4.8 からの移行手順が案内されています。なお Fast モードの対象は Opus 5 と 4.8 に絞られ、Opus 4.7 は Fast の対象から外れました。

ベンチマークで見える「立ち位置」

Anthropic の公表値では、Opus 5 は前世代 Opus 4.8 を大きく上回り、いくつかの指標で Fable 5 を超える、あるいはほぼ並ぶ結果を示しています。開発者に関係の深いところを抜き出すと、次のようになります。

ベンチマークOpus 5Fable 5参考
Frontier-Bench v0.143.3%33.7%GPT-5.6 Sol 34.4%
OSWorld 2.0(PC操作)70.6%66.1%
ARC-AGI-3(新規課題)30.2%Opus 4.8 は 1.5%
AutomationBench26.0%18.1%

コーディングでは、CursorBench 3.2 の最大努力設定で Fable 5 の最高スコアと0.5%差まで詰めつつ、コストは半分に収まると説明されています。一方で全勝ではありません。ソフトウェア工学寄りの DeepSWE v1.1 では GPT-5.6 Sol(72.7%)に対し Opus 5 は68.8%、難問系の Humanity's Last Exam でも Fable 5 にわずかに及ばず、サイバーセキュリティや一部の専門領域では引き続き Mythos 5 が上とされています。「全部で一番」ではなく、「日々のコーディングと知識労働の帯域で、価格対性能が良い」モデルという読み方が実態に近いでしょう。

エージェント運用に効く、地味だが重い変更

今回は数値以外に、長時間エージェントを回すうえで効く運用面の手当てが入りました。開発現場に直接響くのは次の3点です。

  • 会話の途中でツールを差し替えても、キャッシュ済みプロンプトを捨てない。ツール構成を動的に変えるエージェントでも、積み上げた文脈のキャッシュを維持しやすくなります。
  • 安全フィルタに引っかかった要求を、失敗させずフォールバックモデルへ回す。無人運用中に「弾かれて処理が止まる」事態を避けやすくなります。
  • Claude Code の既定 Opus が Opus 5 に。明示的にモデルを固定していないワークフローは、次回以降このモデルで走ります。

「Opus 級の知能を Opus 4.8 と同じ単価で」という設計は、サブエージェントを並列で走らせたり、検証・自己修正を何周も回したりする使い方と相性が良い一方、回せば回すほどトークン消費は積み上がります。既定モデルが強くなったからこそ、Fast モードの倍額や、長丁場のセッションで膨らむ出力トークンをどう見張るかは、これまで以上に設計の論点になります。

「近い・半額」の裏で置いておきたい留保

期待の大きい発表ですが、鵜呑みにせず押さえておきたい点もあります。第一に、リリースの速さです。Opus 5 は Fable 5(6月)、Sonnet 5(6月末)に続く短期間での投入で、モデルが次々に既定を置き換わる状況は、検証やコスト前提の作り直しを現場に迫ります。第二に、ベンチマークの読み方です。一部報道では、Frontier-Bench のスコアに安全フィルタで弾かれた際の Opus 4.8 によるフォールバック分が含まれ、その割合が明示されていないと指摘されています。公表値は「同じ条件での純粋な新モデル性能」とは限らない、という温度で受け取るのが無難です。導入時は自分たちのタスクで小さく試し、コスト実測とあわせて評価する——という基本は変わりません。

とはいえ、値段を上げずに Opus ティアの実力を引き上げ、長時間エージェントの既定を差し替えた今回の更新は、「どのモデルで日々の開発を回すか」を見直す十分な理由になります。まずは手元のワークフローで、既定モデルが Opus 5 に変わったことによる速度・品質・コストの差を確かめるところから始めるとよいでしょう。

参照: Anthropic「Introducing Claude Opus 5」CNBCThe Next Webtech-ish(ベンチマーク詳細・留保点)Claude Code changelog v2.1.219

続きを読む

「一時間を超える処理」を待てるようにした──Codex 0.152が、MCPの出力量と実行時間に“上限のつまみ”を付け、計画ツールを既定オフに回した

「一時間を超える処理」を待てるようにした──Codex 0.152が、MCPの出力量と実行時間に“上限のつまみ”を付け、計画ツールを既定オフに回した

8月31日のCodex v0.152.0と翌日の修正版が、MCPツールの出力量や実行時間に明示的な上限を足し、計画ツールを既定オフに切り替えた。長く走らせる無人・半自動のエージェント運用に効く変更点を整理する。

FF
CLIの既定モデルが、100万トークンの頭に入れ替わった──Claude Code v2.1.257がFable 5.1を標準に据え、自動モードに『封じ込め破り』の関所を足した

CLIの既定モデルが、100万トークンの頭に入れ替わった──Claude Code v2.1.257がFable 5.1を標準に据え、自動モードに『封じ込め破り』の関所を足した

2026年9月1日公開のClaude Code v2.1.257が、既定モデルを100万トークン文脈のFable 5.1へ差し替え。自動モードには資格情報取得や範囲外読み取りを素通しさせない歯止めを追加した。開発者に効く変更点を整理する。

FF
「これは許可された演習だ」――そう言い張って、ランサム集団はCursorのAIエージェントに“実際の侵入作業”をやらせていた

「これは許可された演習だ」――そう言い張って、ランサム集団はCursorのAIエージェントに“実際の侵入作業”をやらせていた

ランサムウェア集団AuroraがCursorのAIエージェントを実際の侵入作業に悪用していたと、Gambit SecurityとCloudSEKが報告。「許可された演習」と偽って安全弁を回り込み、盗んだ認証情報を前提に偵察や権限奪取を代行させていた。開発者を速める道具は、攻撃者も速める――という警鐘。

FF
「買う」より「作る」を選ぶ会社が三社に一社──McKinseyが測った、コーディングエージェントが動かし始めた稟議

「買う」より「作る」を選ぶ会社が三社に一社──McKinseyが測った、コーディングエージェントが動かし始めた稟議

McKinseyの年次調査で、回答者の約3割が「コーディングエージェントで社内開発できる」を理由にソフト購入を見送ったと判明。買うより作るへ傾く調達の変化と、生産性は上がっても利益は動かないという足元の現実を読み解きます。

FF