「安さ」がモデル選びを動かした日──中国製オープンモデルが米国の開発現場を侵食し、コーディングの土台が揺れる

7月7日、米企業の間で中国製オープンモデルの採用が急拡大していると相次ぎ報道。OpenRouterで一時46%、GLM-5.2はOpus 4.8に肉薄しコスト約5分の1。コーディングの土台となるモデル選びが、性能から「性能あたりのコスト」とデータの置き場所へ移りつつあります。

シェア
「安さ」がモデル選びを動かした日──中国製オープンモデルが米国の開発現場を侵食し、コーディングの土台が揺れる

7月7日、複数の米メディアが「中国製AIモデルが米国企業の間で急速に広がっている」と相次いで報じました。背景にあるのは、OpenAIやAnthropicといった米大手モデルの利用コスト上昇です。コーディングエージェントを日常的に回す開発現場にとって、これは「どのモデルの上で開発を進めるか」という土台の話でもあります。数字を追うと、乗り換えは一部の実験ではなく、無視できない規模に達しつつあります。

週あたり3割超、ピークで46%という現実

モデル横断のルーティングを担うOpenRouterでは、米国企業が消費するトークンに占める中国製モデルの割合が、2月8日以降どの週も30%を超え、一時は46%に達したと報じられています。過去12か月の平均が約11%、2025年上半期が4.5%だったことを踏まえると、半年で一桁から四割超へと跳ね上がった計算です。

個別の動きも派手です。デプロイ基盤のVercelでは、後述する中国発モデル「GLM-5.2」の日次トークン量が公開後わずか1週間で約27倍に伸び、2026年で最も速い立ち上がりを記録したとされます。AIスタートアップのLindyに至っては、トラフィックを100%AnthropicのClaudeから中国製のDeepSeekへ移し、CEOのFlo Crivello氏は「数か月で数百万ドルの節約になる見込み」と述べています。

米ブルッキングス研究所のKyle Chan氏は「企業は当初、どのモデルかを問わずAI導入を優先していたが、いまは運用コストにずっと目を向けるようになった」と指摘します。OpenRouterのJustin Summerville氏も、最新の中国製モデルは「もっとも過酷なワークロードを除けば、ほぼすべてをこなせる」水準に来ているとの見方を示しています。

Opus 4.8に肉薄し、コストは約5分の1

この波の象徴が、中国・Z.aiが6月13日にMITライセンスで公開したGLM-5.2です。総パラメータ744BのMoE構成(1回の推論で約40Bが稼働)、コンテキスト長は最大100万トークン。コーディングの実力を測るSWE-bench Proで62.1を記録し、GPT-5.5(58.6)を上回りました。エージェント系のベンチマークではAnthropicのClaude Opus 4.8に1ポイント差まで迫りつつ、トークン単価はおよそ5分の1という評価も出ています。

価格差を並べると、乗り換えの動機がはっきりします(各社公表値・報道値ベース、100万トークンあたり)。

モデル入力出力特徴
GLM-5.2(Z.ai)$1.40$4.40MITライセンスのオープンウェイト
Claude Sonnet 5$2$108月31日までの促進価格
Claude Opus 4.8$5$25Anthropicの最上位級
GPT-5.5$5$30OpenAIの現行フラッグシップ

さらにZ.aiは7月2日、GLM-5.2を核にした無償のデスクトップ開発環境ZCode(macOS/Windows/Linux対応)を公開しました。ターミナルやファイル操作を担うエージェントを備え、他モデルを持ち込むBYOKにも対応します。つまり「安価なオープンモデル」と「それを回すエージェント環境」がセットで出そろい、CursorやClaude Codeが築いた市場に価格から切り込む構図になっています。

手元で回すか、外に預けるか

開発者にとっての要点は、単なる値下げ合戦ではありません。GLM-5.2はMITライセンスでウェイトが公開されているため、Z.aiのホスト型APIを使わず自社環境で動かす(ローカルLLM・オンプレ運用)という選択肢が現実的に取れます。Hugging FaceのYacine Jernite氏が「組織は自分たちで制御・改変できるAIを求めるようになっている」と語る通り、オープンウェイトは乗り換えコストとロックインの両方を下げる方向に働きます。

一方で、利便性の裏に留意点も指摘されています。安価さに惹かれてホスト型APIをそのまま使う場合、リクエストは海外の事業者を経由することになり、扱うコードやデータの管轄・秘匿の観点で慎重な検討が要る、という声もあります。機微なコードを含む用途では、ホストAPIで手早く試すのか、オープンウェイトを自社で閉じて回すのかを、コストだけでなくデータの置き場所で切り分ける判断が現実的でしょう。品質・速度・単価に加え、どこにデータを通すかまで含めて比較する段階に入ったと言えます。

コスト競争が開発の前提を書き換える

今回の動きが示すのは、フロンティアモデルの性能そのものよりも「性能あたりのコスト」が、実運用のモデル選定を左右し始めたことです。米大手にとっては値付けの再考を迫る圧力になり、開発者にとっては、コーディングエージェントの土台を1社に固定せず、用途ごとに使い分ける前提が整いつつあります。もっとも、ベンチマークは特定条件での相対値であり、自社の実タスクで最上位モデルと差が出る場面は残ります。まずは非機微な反復作業から安価なオープンモデルを試し、効果とリスクを見極めながら適用範囲を広げる──そうした地に足のついた取り込み方が、当面の落としどころになりそうです。

参照: CNBC「Chinese AI models are gaining ground with U.S. companies as OpenAI, Anthropic costs surge」IBTimes「Chinese AI Models Are Winning Customers On Price」VentureBeat「Z.ai's open-weights GLM-5.2 beats GPT-5.5...」ChatForest「ZCode: Z.ai's Agent-First Coding IDE」Rest of World「Low-cost Chinese AI models like DeepSeek gain traction in the U.S.」

続きを読む

締めた手綱を、2日で少し緩める──Claude Code v2.1.219が入れ子サブエージェントを「既定で深さ3」へ戻し、ワークフローに「15体未満」の目安を入れた

締めた手綱を、2日で少し緩める──Claude Code v2.1.219が入れ子サブエージェントを「既定で深さ3」へ戻し、ワークフローに「15体未満」の目安を入れた

Claude Code v2.1.219が、2日前に既定オフにした入れ子サブエージェントを「既定で深さ3」へ戻し、動的ワークフローに「15体未満」の目安を新設。自律性と安全性の綱引きと、無人運用での当てどころを整理します。

FF
一度こしらえた拡張を、別のエージェントで使い回す──Copilot CLIがOpen Plugin SpecとMCP設定を取り込み、砂場は「既定で締める」側へ

一度こしらえた拡張を、別のエージェントで使い回す──Copilot CLIがOpen Plugin SpecとMCP設定を取り込み、砂場は「既定で締める」側へ

GitHub Copilot CLI の最新版が、ベンダー中立の「Open Plugin Spec」と MCP 設定ファイルを読み込めるようになった。他のエージェント向けに作った拡張がそのまま持ち込める一方、OSサンドボックスの初期値は締める方向へ動いた。

FF
キーボードから手を離し、口でエージェントを回す──OpenAIがCodex/Workに載せた「全二重」音声操作と、その速さが呼ぶ取りこぼし

キーボードから手を離し、口でエージェントを回す──OpenAIがCodex/Workに載せた「全二重」音声操作と、その速さが呼ぶ取りこぼし

OpenAIがChatGPTデスクトップに音声操作を配信。全二重のGPT-Liveで、声だけでCodex/Workの複数エージェントを回せる。段取りは速くなるが、口頭指示の曖昧さと文字起こしのズレという新しい取りこぼしも。

FF
Fable 5級の知能を、据え置きの値段で回す──Claude Opus 5が「長時間エージェントのOpus」を作り直した

Fable 5級の知能を、据え置きの値段で回す──Claude Opus 5が「長時間エージェントのOpus」を作り直した

Anthropicが7月24日にClaude Opus 5を公開。据え置きの$5/$25で公開最上位Fable 5に迫る性能を打ち出し、Claude Codeの既定Opusも置き換え。料金・ベンチ・エージェント運用の変化と留保点を整理します。

FF