「並べて待つ」から「話しながら組む」へ──Codexに載るGPT-5.6 Sol Ultra、協調するサブエージェントと“採点”への疑い
OpenAIのSottiaux氏が、GPT-5.6の最上位「Sol Ultra」をCodexに載せると表明。独立並列でなく“走りながら相談する”協調サブエージェントが特徴だが、費用の膨張とMETRが指摘するベンチマーク不正という宿題も同時に抱える。
OpenAIのSottiaux氏が、GPT-5.6の最上位「Sol Ultra」をCodexに載せると表明。独立並列でなく“走りながら相談する”協調サブエージェントが特徴だが、費用の膨張とMETRが指摘するベンチマーク不正という宿題も同時に抱える。
7月7日、米企業の間で中国製オープンモデルの採用が急拡大していると相次ぎ報道。OpenRouterで一時46%、GLM-5.2はOpus 4.8に肉薄しコスト約5分の1。コーディングの土台となるモデル選びが、性能から「性能あたりのコスト」とデータの置き場所へ移りつつあります。
Claude Code v2.1.202が公開。動的ワークフローに規模の目安を選ぶ「Dynamic workflow size」設定と、1,000体の実行を後から追えるテレメトリ属性が加わりました。速さの裏にあるトークン消費と、その手綱の握り方を整理します。
Anthropicの最上位モデルClaude Fable 5が、7月8日から有料プラン同梱の扱いを外れ、使った分だけ支払う従量課金(入力$10/出力$50・百万トークン)へ切り替わる。何もしないと翌日Fable 5だけ止まる。開発者が今日確認すべき設定と、モデルの振り分け方針を整理する。
グーグルの製品責任者が競合のClaude Codeを使い、2003年のRTSをiPhoneにネイティブ移植。コーディングエージェントが新規開発だけでなく「移植・近代化」という地味な難所に踏み込んだ事例を、実務の勘所と数字の読み方まで整理します。
Anthropic が研究者向けの新ツール「Claude Science」をベータ公開。答えを組み立てるエージェントとは別に、引用と数字を疑う検算役を常駐させる多エージェント設計は、生成AIで業務や開発を自動化する人にも示唆を与えます。
Claude Code v2.1.198が追加した組み込みスキル/dataviz。チャート選択・レイアウト・視覚階層の指針をコンテキストに読み込ませ、配色を実際に検証するバリデータも同梱する。AIに図表デザインの作法を仕込む仕組みを解説します。
Claude Code v2.1.199で、先頭に並べたスキルを最大5つまで同時に読み込めるように。単発の手順を組み合わせてワークフロー化できる。無人運用向けの取りこぼし修正も同時に入った。
Claude Code 2.1.198〜2.1.201で、サブエージェントが既定でバックグラウンド実行に。完了通知やドラフトPR自動作成で「委譲して離れる」が標準へ。だが同じ週の2.1.200は既定の権限モードを「手動」に引き締めた。
Claude Code 2.1.196で、管理者が組織全体の既定モデルを一括設定できる「組織デフォルトモデル」が追加。Sonnet 5デフォルト化の直後に、チームでどのモデルを走らせるかをそろえる手綱が届きました。
6月30日公開のClaude Sonnet 5が、翌日配信のClaude Code v2.1.197で既定モデルに。100万トークン文脈とOpus級の自律性を、導入価格$2/$10のSonnet単価で回せる一方、総額増や安全性の性格差など留意点も。
AnthropicとマイクロソフトはClaude(Opus 4.8/Haiku 4.5)をMicrosoft Foundryで正式提供にした。Azureの認証・請求・統制のまま自社環境で動かせ、企業の導入ハードルを下げる。