1トークンずつ書くのをやめたGemma──Googleの「DiffusionGemma」が手元のGPUで狙う毎秒1,000トークン
Google DeepMindが実験的オープンモデル「DiffusionGemma」を公開。1トークンずつ書く方式をやめ、256トークンを一括生成する拡散方式で手元のGPUでも最大4倍速。Apache 2.0で誰でも入手でき、速度と品質の割り切りを開発者目線で整理します。
Google DeepMindが実験的オープンモデル「DiffusionGemma」を公開。1トークンずつ書く方式をやめ、256トークンを一括生成する拡散方式で手元のGPUでも最大4倍速。Apache 2.0で誰でも入手でき、速度と品質の割り切りを開発者目線で整理します。
Googleが2026年6月3日に発表した「Gemma 4 12B」は、16GBのノートPCで動きながら26B級に迫る性能を示すオープンモデル。ローカルLLMと内製運用の現実味を一段押し上げます。