Gemma 4のステルス更新とは?Flash Attention 4で最大70%高速化・ツール呼び出し修正を解説
Googleは2026年7月16日、オープンモデル「Gemma 4」を版名を変えないまま更新し、Nvidia Hopper GPU上でのプロンプト処理をFlash Attention 4で25〜70%高速化、初回トークンまでの時間を最大31%短縮した。ツール呼び出しのバグと回答の途中切れも修正している。
Googleは2026年7月16日、オープンモデル「Gemma 4」を版名を変えないまま更新し、Nvidia Hopper GPU上でのプロンプト処理をFlash Attention 4で25〜70%高速化、初回トークンまでの時間を最大31%短縮した。ツール呼び出しのバグと回答の途中切れも修正している。
DeepReinforceが2026年6月29日、Gemma 4とQwen 3.5をベースにしたエージェンティックコーディング向けLLM「Ornith-1.0」をMITライセンスで公開しました。9B〜397Bの4バリアントが揃い、同規模オープンモデルでコーディングベンチマークの最高水準を達成したとされます。