生成AI

Reviews Move Out of the Conversation, Deep Dives Wait to Be Called — How Claude Code v2.1.218 Draws the Line at "No Running Off on Its Own"

Reviews Move Out of the Conversation, Deep Dives Wait to Be Called — How Claude Code v2.1.218 Draws the Line at "No Running Off on Its Own"

Claude Code v2.1.218 looks like a bundle of minor fixes, but a single thread runs through it. /code-review now runs in the background, /deep-research launches only when invoked manually, and fork skills default to running behind the scenes—pushing heavy automated work out of the conversation so noth

By FF
レビューは会話の外へ、深掘りは呼ぶまで動かない──Claude Code v2.1.218が引いた「勝手に走らせない」の線

レビューは会話の外へ、深掘りは呼ぶまで動かない──Claude Code v2.1.218が引いた「勝手に走らせない」の線

Claude Code v2.1.218は細かな修正の束に見えて、一本の筋が通っている。/code-reviewをバックグラウンド実行にし、/deep-researchは手動起動のみに、forkスキルも既定で裏へ——重い自動作業を会話の外へ出し、勝手に走らせない。無人運用で効く「既定の締め直し」を開発者視点で整理する。

FF
Leaving the 'Pro' Seat Empty, Three Cheap-and-Fast Flash Models Instead — How Gemini's Refresh Targets the Token Bill of Keeping Agents Running

Leaving the 'Pro' Seat Empty, Three Cheap-and-Fast Flash Models Instead — How Gemini's Refresh Targets the Token Bill of Keeping Agents Running

On July 21, Google refreshed three Gemini Flash models. It again held back the flagship 3.5 Pro, instead strengthening the mid-tier — including a 3.6 Flash that cuts output tokens by 17% — to target "the cost of keeping agents running." A developer-focused rundown covering price tags, benchmarks, an

By FF
『Pro』の席は空けたまま、安く速いFlashを3枚──Gemini刷新が突く、エージェントを回し続けるトークン代

『Pro』の席は空けたまま、安く速いFlashを3枚──Gemini刷新が突く、エージェントを回し続けるトークン代

Googleが7月21日にGemini Flashを3モデル更新。旗艦3.5 Proは今回も見送り、出力トークン17%減の3.6 Flashなど「エージェントを回し続けるコスト」に効く中位帯を強化した。値札・ベンチ・セキュリティ特化Cyberの限定配布まで、開発者視点で整理する。

FF
サブエージェントは200体まで、検索は200回まで──Claude Code v2.1.212が暴走に置いた「予算」

サブエージェントは200体まで、検索は200回まで──Claude Code v2.1.212が暴走に置いた「予算」

Claude Code v2.1.212 が、サブエージェントの起動とWeb検索に1セッション200回の上限を設けました。30分で120万トークンを溶かした暴走報告を背景に、/fork のバックグラウンド化やプランモードの権限漏れ修正も入っています。

FF
AIが書いたコードを「使い捨ての檻」で走らせる──Cloud Run サンドボックスが、エージェント実行の安全弁を数ミリ秒で配る

AIが書いたコードを「使い捨ての檻」で走らせる──Cloud Run サンドボックスが、エージェント実行の安全弁を数ミリ秒で配る

Google が Cloud Run サンドボックスをパブリックプレビュー公開。AIが生成した信頼できないコードを、使い捨ての隔離空間で数ミリ秒で走らせる。認証情報・外部通信・書き込みを既定で遮断し、追加料金なしでエージェント実行の安全弁を配る。

FF
コードの隣にブラウザが座る──Claude Code デスクトップの内蔵ブラウザが、エージェントに「自分で見て、触る」目を与えた

コードの隣にブラウザが座る──Claude Code デスクトップの内蔵ブラウザが、エージェントに「自分で見て、触る」目を与えた

デスクトップ版Claude Codeに内蔵ブラウザが登場。エージェントが自らドキュメントや画面を開き、読んで・クリックして操作できる。ウィンドウの往復を減らす利便性の裏で、悪意あるページへの露出というリスクにも触れる。

FF
本流を止めずに脇道で調べる──Cursor 3.11の「サイドチャット」が、走らせたままの相談を可能にした

本流を止めずに脇道で調べる──Cursor 3.11の「サイドチャット」が、走らせたままの相談を可能にした

Cursor 3.11が「サイドチャット」を追加。/side や /btw で、本流のエージェント作業を止めないまま文脈を引き継いだ相談を脇で始め、@で本流に引き戻せる。トランスクリプト検索の強化とあわせ、並列実行の次に来た細やかな分業を整理します。

FF
「使うと決めて有効化」から「黙っていても有効」へ──Claude Code v2.1.207が企業クラウドで自動モードを既定にした日

「使うと決めて有効化」から「黙っていても有効」へ──Claude Code v2.1.207が企業クラウドで自動モードを既定にした日

Claude Code v2.1.207で、1操作ごとの確認を省く自動モードがBedrock・Vertex AI・Foundryの3経路で既定有効に。環境変数による申し込み制から初期状態でONへ。改竄防止などの安全策と、無効化の手綱をどこで握るかを整理します。

FF
Cursorのデータで鍛えた「Opus級」──SpaceXAIのGrok 4.5が、安さでコーディング現場に差し込む

Cursorのデータで鍛えた「Opus級」──SpaceXAIのGrok 4.5が、安さでコーディング現場に差し込む

SpaceXAI(旧xAI)が旗艦モデルGrok 4.5を公開。買収したCursorのデータで訓練した「Opus級」を、入力$2/出力$6という低価格で提供し、Cursor全階層に統合。コーディング現場の価格競争を一段進める一手を開発者目線で整理します。

FF
「安さ」がモデル選びを動かした日──中国製オープンモデルが米国の開発現場を侵食し、コーディングの土台が揺れる

「安さ」がモデル選びを動かした日──中国製オープンモデルが米国の開発現場を侵食し、コーディングの土台が揺れる

7月7日、米企業の間で中国製オープンモデルの採用が急拡大していると相次ぎ報道。OpenRouterで一時46%、GLM-5.2はOpus 4.8に肉薄しコスト約5分の1。コーディングの土台となるモデル選びが、性能から「性能あたりのコスト」とデータの置き場所へ移りつつあります。

FF
答えを出す係と、それを疑う係を分ける──Anthropicの新ツール「Claude Science」が研究に持ち込んだ多エージェント設計

答えを出す係と、それを疑う係を分ける──Anthropicの新ツール「Claude Science」が研究に持ち込んだ多エージェント設計

Anthropic が研究者向けの新ツール「Claude Science」をベータ公開。答えを組み立てるエージェントとは別に、引用と数字を疑う検算役を常駐させる多エージェント設計は、生成AIで業務や開発を自動化する人にも示唆を与えます。

FF