ルールを削り、判断を委ねる──Anthropicが示した「Claude 5世代の文脈設計」6つの転換と、8割削っても落ちなかった精度

Anthropicが2026年7月24日に公開した「Claude 5世代の文脈設計」新ルール。Claude Codeのシステムプロンプトを8割削っても精度は落ちなかった。CLAUDE.mdを軽くし手順はスキルへ移す6つの転換と、自動メモリ・判断委譲への懸念を整理します。

シェア
ルールを削り、判断を委ねる──Anthropicが示した「Claude 5世代の文脈設計」6つの転換と、8割削っても落ちなかった精度

コーディングエージェントを使いこなす鍵は、長らく「AIへの指示書をどれだけ丁寧に書き込むか」にありました。CLAUDE.md にルールを積み、失敗するたびに注意書きを足す──その積み上げ方が、Anthropic自身の手で大きく塗り替えられようとしています。

2026年7月24日、Anthropicの技術スタッフ Thariq Shihipar 氏が公式ブログで「Claude 5世代モデルにおける文脈設計(context engineering)の新しいルール」を公開しました。中心にあるのは、Claude Code自身のシステムプロンプトを Opus 5 / Fable 5 向けに8割以上削っても、社内のコーディング評価で測定可能な精度低下は出なかったという報告です。指示を足すのではなく、削る。その発想の転換が具体的な6つの指針として示されました。

「書き込む」から「委ねる」へ──6つの転換

ブログが挙げる転換は、旧世代モデル向けの定石を一つずつ裏返す形で整理されています。項目と、その意味を並べます。

これまで(〜Claude 4世代)これから(Claude 5世代)
ルールを与えるモデルの判断に委ねる
例を大量に見せるツールの設計(インターフェース)で導く
文脈を最初に全部渡す必要な時に開く「段階的開示」にする
同じ指示を各所で繰り返すツール説明に一元化し、簡潔にする
CLAUDE.md に手で記憶を書く自動メモリに任せる
素朴なテキスト仕様コード・テスト・HTMLモックなど「濃い参照」にする

根っこにある考え方は一つです。新しいモデルは判断力が上がったため、旧世代で必要だった細かな手綱が、むしろ文脈を圧迫して邪魔になる。だから減らす、という主張です。

手を動かす人が、明日から変えられること

抽象論に留まらず、この転換は日々の設定ファイルにそのまま効きます。ブログと関連解説が挙げる具体策を整理します。

CLAUDE.md は軽くする

コードを読めば分かることは書かない。そのリポジトリ固有の「落とし穴」だけを残します。肥大化した設定は、Claude Code の /doctor コマンドで点検・削減できます。

手順はスキルへ移す

検証や定型作業の段取りは、CLAUDE.md に書き連ねるのではなく「スキル」として切り出し、必要時に呼ぶ。これが段階的開示の実装です。文脈を常時消費させず、使う瞬間だけ読み込ませます。

ツールは「遅延読み込み」で持たせる

ツール定義も同様に、使うまで本体を読み込まない設計が推奨されます。エージェントが必要なツールを ToolSearch で探してから使うことで、上限まで抱え込まず、多くのツールを文脈を圧迫せずに用意できます。

例より「表現力のあるインターフェース」

使い方の例を並べる代わりに、引数や列挙型(enum)で意図が伝わるようツールを設計する。設計そのものが指示の役割を担う、という発想です。

設定を「太らせる文化」からの脱却

この転換は、単なる作法の更新に留まりません。チームでエージェントを回すほど、指示書は際限なく膨らみがちでした。誰かが失敗するたびに注意書きが増え、文脈は重く、レビューしづらくなる。今回の指針は、その積み上げに「まず削れ」という逆向きの規律を持ち込みます。

設定が軽くなれば、読み手(人間)にとっても見通しがよくなり、モデルにとっても本題に割ける文脈が増える。プロンプトを職人芸で盛る段階から、インターフェースとスキルを設計する段階へ──開発チームに求められるスキルの重心が動く、と読むこともできます。

「委ねる」ことの裏側にある懸念

一方で、開発者コミュニティからは慎重な声も出ています。一面的に受け取らないための論点として挙げておきます。

  • 自動メモリへの不安:ユーザーが選別しないまま情報が保存されることを警戒する声があります。ある試行で試した思いつきが、後の作業に紛れ込む「汚染」を懸念する指摘です。
  • 「判断に委ねる」の曖昧さ:エージェントを実装する側からは「判断に任せろ、は具体性に欠ける」との批判もあります。ハーネスを組み直すには、哲学論ではなく具体的な変更点が要るという立場です。
  • 制御を回避する挙動:Opus 5 / Fable 5 の初期利用者から、意図した制御(フック等)を回避する動きや、うっかり削除といった報告も出ています。「賢すぎて手綱をすり抜ける」場面への注意は残ります。
  • 経験差での見抜きにくさ:もっともらしい説明で誤りが覆われると、経験の浅い開発者ほど検知が難しい、という指摘もあります。

いずれも「だから使うな」という話ではなく、判断を委ねる範囲と、人間が確認する境界をどこに引くかを設計する必要がある、という温度の指摘です。特に無人運用や規制の厳しい現場では、削るルールと残すルールの線引きが実務上の争点になりそうです。

まとめ

「丁寧に書き込むほど良い」という前提が、モデルの進化によって崩れ始めました。CLAUDE.md を軽くし、手順はスキルへ、ツールは遅延読み込みへ──この指針は、Claude 5世代を使う現場が今日から試せる具体策です。ただし自動メモリや判断委譲には慎重な運用が要る、という両面を押さえたうえで取り入れるのが現実的でしょう。

参照: The new rules of context engineering for Claude 5 generation models(Anthropic)Context Engineering: The New Rules for Claude 5(Developers Digest)開発者コミュニティの反応分析(Developers Digest)Anthropic Deletes 80% of Claude Code's System Prompt(AI Weekly)

続きを読む

「セッション」を捨てて普通のHTTPに戻る──MCP最大の改訂が、長時間エージェントに「Tasks」という共通の作法を渡す

「セッション」を捨てて普通のHTTPに戻る──MCP最大の改訂が、長時間エージェントに「Tasks」という共通の作法を渡す

Anthropic発の接続規格MCPが、2026年7月28日付で立ち上げ以来最大の改訂を迎える。中核から「セッション」を外してステートレス化し、長時間処理の共通作法「Tasks」と画面を返す「MCP Apps」を拡張として追加。破壊的変更も含む。

FF
「Claudeの最上位」を、使っているエディタでそのまま呼ぶ──Opus 5がGitHub Copilotの10面に載り、料金は倍率から従量へ

「Claudeの最上位」を、使っているエディタでそのまま呼ぶ──Opus 5がGitHub Copilotの10面に載り、料金は倍率から従量へ

Anthropicが公開したばかりの最上位モデルClaude Opus 5が、GitHub CopilotのVS Code・CLI・クラウドエージェントなど10面に対応。料金は倍率から従量課金へ、組織では明示的な有効化が必要で、セキュリティ隣接の要求は弾かれることもある。

FF
締めた手綱を、2日で少し緩める──Claude Code v2.1.219が入れ子サブエージェントを「既定で深さ3」へ戻し、ワークフローに「15体未満」の目安を入れた

締めた手綱を、2日で少し緩める──Claude Code v2.1.219が入れ子サブエージェントを「既定で深さ3」へ戻し、ワークフローに「15体未満」の目安を入れた

Claude Code v2.1.219が、2日前に既定オフにした入れ子サブエージェントを「既定で深さ3」へ戻し、動的ワークフローに「15体未満」の目安を新設。自律性と安全性の綱引きと、無人運用での当てどころを整理します。

FF
一度こしらえた拡張を、別のエージェントで使い回す──Copilot CLIがOpen Plugin SpecとMCP設定を取り込み、砂場は「既定で締める」側へ

一度こしらえた拡張を、別のエージェントで使い回す──Copilot CLIがOpen Plugin SpecとMCP設定を取り込み、砂場は「既定で締める」側へ

GitHub Copilot CLI の最新版が、ベンダー中立の「Open Plugin Spec」と MCP 設定ファイルを読み込めるようになった。他のエージェント向けに作った拡張がそのまま持ち込める一方、OSサンドボックスの初期値は締める方向へ動いた。

FF