AIエージェント

Claude Believed It "Wasn't Connected to the Internet" — Then Attacked Three Real Companies: The Evaluation-Environment Gap Anthropic Found in a Self-Audit

Claude Believed It "Wasn't Connected to the Internet" — Then Attacked Three Real Companies: The Evaluation-Environment Gap Anthropic Found in a Self-Audit

Anthropic disclosed that during its own safety evaluations, Claude escaped an isolated environment and broke into three real-world companies. The cause was not a "rogue model" but a misconfigured evaluation environment. It raises the question of how strong the sandbox confining our agents really is.

By FF
「ネットには繋がっていない」と信じたClaudeが、実在3社を攻撃していた──Anthropicが自己点検で見つけた評価環境の穴

「ネットには繋がっていない」と信じたClaudeが、実在3社を攻撃していた──Anthropicが自己点検で見つけた評価環境の穴

Anthropicが、自社の安全性評価中にClaudeが隔離環境を抜け出し実在3社に侵入していたと公表。原因は「モデルの暴走」でなく評価環境の設定ミスでした。エージェントを閉じ込める砂場の強度が問われます。

FF
‘Agents’ Is Closed to Newcomers—Continue with ‘AgentCore’: How AWS Rebuilt the Foundation for Agents in Two and a Half Years

‘Agents’ Is Closed to Newcomers—Continue with ‘AgentCore’: How AWS Rebuilt the Foundation for Agents in Two and a Half Years

AWS has stopped accepting new customers for its flagship "Amazon Bedrock Agents," appending the "Classic" label and shifting its focus to the successor, "AgentCore." It's a move from an all-in-one finished product to a composable foundation that's agnostic to framework and model. We walk through the

By FF
『Agents』は新規お断り、続きは『AgentCore』で──AWSが2年半で作り替えた、エージェントの土台

『Agents』は新規お断り、続きは『AgentCore』で──AWSが2年半で作り替えた、エージェントの土台

AWSが看板の「Amazon Bedrock Agents」を新規受付停止にし、名称に『Classic』を付けて後継の『AgentCore』へ主軸を移しました。一体型の完成品から、フレームワークもモデルも問わない組み替え式の基盤へ。移行の作業と、従量課金で請求が膨らむ注意点まで読み解きます。

FF
AIが書いたコードを「使い捨ての檻」で走らせる──Cloud Run サンドボックスが、エージェント実行の安全弁を数ミリ秒で配る

AIが書いたコードを「使い捨ての檻」で走らせる──Cloud Run サンドボックスが、エージェント実行の安全弁を数ミリ秒で配る

Google が Cloud Run サンドボックスをパブリックプレビュー公開。AIが生成した信頼できないコードを、使い捨ての隔離空間で数ミリ秒で走らせる。認証情報・外部通信・書き込みを既定で遮断し、追加料金なしでエージェント実行の安全弁を配る。

FF
答えを出す係と、それを疑う係を分ける──Anthropicの新ツール「Claude Science」が研究に持ち込んだ多エージェント設計

答えを出す係と、それを疑う係を分ける──Anthropicの新ツール「Claude Science」が研究に持ち込んだ多エージェント設計

Anthropic が研究者向けの新ツール「Claude Science」をベータ公開。答えを組み立てるエージェントとは別に、引用と数字を疑う検算役を常駐させる多エージェント設計は、生成AIで業務や開発を自動化する人にも示唆を与えます。

FF
AIエージェントは「git clone」をやめる──GitLabが作り直したエージェント時代のGit基盤

AIエージェントは「git clone」をやめる──GitLabが作り直したエージェント時代のGit基盤

GitLabがTranscend 2026で、エージェント向けに作り直す次世代ソースコード管理を発表。リポジトリのcloneをやめ構造化APIに寄せることで、最大50倍高速・通信量1000分の1をうたう。文脈グラフOrbitや統制機能も同時に整え、エージェント量産投入の足場を狙う。

FF
IDEは「必須」から「選択肢」へ──Gartnerが読むエージェント開発の地殻変動

IDEは「必須」から「選択肢」へ──Gartnerが読むエージェント開発の地殻変動

2027年までにエージェント型コーディングを使うチームの65%超がIDEを不可欠と考えなくなる──Gartnerの予測を、開発者目線で読み解きます。何が中心を動かすのか、利便性の裏にあるスキル空洞化の懸念まで。

FF
ChatGPTの「Lockdown Mode」は何を犠牲に守るのか──OpenAIが引いたプロンプトインジェクションの最後の線

ChatGPTの「Lockdown Mode」は何を犠牲に守るのか──OpenAIが引いたプロンプトインジェクションの最後の線

OpenAIがChatGPTに「Lockdown Mode」を導入。Web閲覧やエージェントモード、コネクターを制限してプロンプトインジェクションによる情報流出を抑える。Codexにも及ぶ「高リスク」ラベルと、利便性と安全のトレードオフを読み解く。

FF