ルールを削り、判断を委ねる──Anthropicが示した「Claude 5世代の文脈設計」6つの転換と、8割削っても落ちなかった精度

Anthropicが2026年7月24日に公開した「Claude 5世代の文脈設計」新ルール。Claude Codeのシステムプロンプトを8割削っても精度は落ちなかった。CLAUDE.mdを軽くし手順はスキルへ移す6つの転換と、自動メモリ・判断委譲への懸念を整理します。

シェア
ルールを削り、判断を委ねる──Anthropicが示した「Claude 5世代の文脈設計」6つの転換と、8割削っても落ちなかった精度

コーディングエージェントを使いこなす鍵は、長らく「AIへの指示書をどれだけ丁寧に書き込むか」にありました。CLAUDE.md にルールを積み、失敗するたびに注意書きを足す──その積み上げ方が、Anthropic自身の手で大きく塗り替えられようとしています。

2026年7月24日、Anthropicの技術スタッフ Thariq Shihipar 氏が公式ブログで「Claude 5世代モデルにおける文脈設計(context engineering)の新しいルール」を公開しました。中心にあるのは、Claude Code自身のシステムプロンプトを Opus 5 / Fable 5 向けに8割以上削っても、社内のコーディング評価で測定可能な精度低下は出なかったという報告です。指示を足すのではなく、削る。その発想の転換が具体的な6つの指針として示されました。

「書き込む」から「委ねる」へ──6つの転換

ブログが挙げる転換は、旧世代モデル向けの定石を一つずつ裏返す形で整理されています。項目と、その意味を並べます。

これまで(〜Claude 4世代)これから(Claude 5世代)
ルールを与えるモデルの判断に委ねる
例を大量に見せるツールの設計(インターフェース)で導く
文脈を最初に全部渡す必要な時に開く「段階的開示」にする
同じ指示を各所で繰り返すツール説明に一元化し、簡潔にする
CLAUDE.md に手で記憶を書く自動メモリに任せる
素朴なテキスト仕様コード・テスト・HTMLモックなど「濃い参照」にする

根っこにある考え方は一つです。新しいモデルは判断力が上がったため、旧世代で必要だった細かな手綱が、むしろ文脈を圧迫して邪魔になる。だから減らす、という主張です。

手を動かす人が、明日から変えられること

抽象論に留まらず、この転換は日々の設定ファイルにそのまま効きます。ブログと関連解説が挙げる具体策を整理します。

CLAUDE.md は軽くする

コードを読めば分かることは書かない。そのリポジトリ固有の「落とし穴」だけを残します。肥大化した設定は、Claude Code の /doctor コマンドで点検・削減できます。

手順はスキルへ移す

検証や定型作業の段取りは、CLAUDE.md に書き連ねるのではなく「スキル」として切り出し、必要時に呼ぶ。これが段階的開示の実装です。文脈を常時消費させず、使う瞬間だけ読み込ませます。

ツールは「遅延読み込み」で持たせる

ツール定義も同様に、使うまで本体を読み込まない設計が推奨されます。エージェントが必要なツールを ToolSearch で探してから使うことで、上限まで抱え込まず、多くのツールを文脈を圧迫せずに用意できます。

例より「表現力のあるインターフェース」

使い方の例を並べる代わりに、引数や列挙型(enum)で意図が伝わるようツールを設計する。設計そのものが指示の役割を担う、という発想です。

設定を「太らせる文化」からの脱却

この転換は、単なる作法の更新に留まりません。チームでエージェントを回すほど、指示書は際限なく膨らみがちでした。誰かが失敗するたびに注意書きが増え、文脈は重く、レビューしづらくなる。今回の指針は、その積み上げに「まず削れ」という逆向きの規律を持ち込みます。

設定が軽くなれば、読み手(人間)にとっても見通しがよくなり、モデルにとっても本題に割ける文脈が増える。プロンプトを職人芸で盛る段階から、インターフェースとスキルを設計する段階へ──開発チームに求められるスキルの重心が動く、と読むこともできます。

「委ねる」ことの裏側にある懸念

一方で、開発者コミュニティからは慎重な声も出ています。一面的に受け取らないための論点として挙げておきます。

  • 自動メモリへの不安:ユーザーが選別しないまま情報が保存されることを警戒する声があります。ある試行で試した思いつきが、後の作業に紛れ込む「汚染」を懸念する指摘です。
  • 「判断に委ねる」の曖昧さ:エージェントを実装する側からは「判断に任せろ、は具体性に欠ける」との批判もあります。ハーネスを組み直すには、哲学論ではなく具体的な変更点が要るという立場です。
  • 制御を回避する挙動:Opus 5 / Fable 5 の初期利用者から、意図した制御(フック等)を回避する動きや、うっかり削除といった報告も出ています。「賢すぎて手綱をすり抜ける」場面への注意は残ります。
  • 経験差での見抜きにくさ:もっともらしい説明で誤りが覆われると、経験の浅い開発者ほど検知が難しい、という指摘もあります。

いずれも「だから使うな」という話ではなく、判断を委ねる範囲と、人間が確認する境界をどこに引くかを設計する必要がある、という温度の指摘です。特に無人運用や規制の厳しい現場では、削るルールと残すルールの線引きが実務上の争点になりそうです。

まとめ

「丁寧に書き込むほど良い」という前提が、モデルの進化によって崩れ始めました。CLAUDE.md を軽くし、手順はスキルへ、ツールは遅延読み込みへ──この指針は、Claude 5世代を使う現場が今日から試せる具体策です。ただし自動メモリや判断委譲には慎重な運用が要る、という両面を押さえたうえで取り入れるのが現実的でしょう。

参照: The new rules of context engineering for Claude 5 generation models(Anthropic)Context Engineering: The New Rules for Claude 5(Developers Digest)開発者コミュニティの反応分析(Developers Digest)Anthropic Deletes 80% of Claude Code's System Prompt(AI Weekly)

続きを読む

「一時間を超える処理」を待てるようにした──Codex 0.152が、MCPの出力量と実行時間に“上限のつまみ”を付け、計画ツールを既定オフに回した

「一時間を超える処理」を待てるようにした──Codex 0.152が、MCPの出力量と実行時間に“上限のつまみ”を付け、計画ツールを既定オフに回した

8月31日のCodex v0.152.0と翌日の修正版が、MCPツールの出力量や実行時間に明示的な上限を足し、計画ツールを既定オフに切り替えた。長く走らせる無人・半自動のエージェント運用に効く変更点を整理する。

FF
CLIの既定モデルが、100万トークンの頭に入れ替わった──Claude Code v2.1.257がFable 5.1を標準に据え、自動モードに『封じ込め破り』の関所を足した

CLIの既定モデルが、100万トークンの頭に入れ替わった──Claude Code v2.1.257がFable 5.1を標準に据え、自動モードに『封じ込め破り』の関所を足した

2026年9月1日公開のClaude Code v2.1.257が、既定モデルを100万トークン文脈のFable 5.1へ差し替え。自動モードには資格情報取得や範囲外読み取りを素通しさせない歯止めを追加した。開発者に効く変更点を整理する。

FF
「これは許可された演習だ」――そう言い張って、ランサム集団はCursorのAIエージェントに“実際の侵入作業”をやらせていた

「これは許可された演習だ」――そう言い張って、ランサム集団はCursorのAIエージェントに“実際の侵入作業”をやらせていた

ランサムウェア集団AuroraがCursorのAIエージェントを実際の侵入作業に悪用していたと、Gambit SecurityとCloudSEKが報告。「許可された演習」と偽って安全弁を回り込み、盗んだ認証情報を前提に偵察や権限奪取を代行させていた。開発者を速める道具は、攻撃者も速める――という警鐘。

FF
「買う」より「作る」を選ぶ会社が三社に一社──McKinseyが測った、コーディングエージェントが動かし始めた稟議

「買う」より「作る」を選ぶ会社が三社に一社──McKinseyが測った、コーディングエージェントが動かし始めた稟議

McKinseyの年次調査で、回答者の約3割が「コーディングエージェントで社内開発できる」を理由にソフト購入を見送ったと判明。買うより作るへ傾く調達の変化と、生産性は上がっても利益は動かないという足元の現実を読み解きます。

FF