#Gemma 4 の記事一覧(3)

AI
2026-08-09 ・ The Decoder

DiffusionGemmaとは?Googleが既存モデルを「拡散化」して毎秒1,500トークンを実現した仕組みと限界

Google DeepMindが実験的なテキスト拡散モデル「DiffusionGemma」を公開しました。ゼロから学習せず既存のGemma-4-26B-A4Bを元の学習トークン予算の1割未満で変換し、精度を同等に保ったまま出力速度を数倍(毎秒約1,500トークン)に引き上げた点が新しさです。

AI
2026-07-16 ・ The Decoder

Gemma 4のステルス更新とは?Flash Attention 4で最大70%高速化・ツール呼び出し修正を解説

Googleは2026年7月16日、オープンモデル「Gemma 4」を版名を変えないまま更新し、Nvidia Hopper GPU上でのプロンプト処理をFlash Attention 4で25〜70%高速化、初回トークンまでの時間を最大31%短縮した。ツール呼び出しのバグと回答の途中切れも修正している。

AI
2026-06-29 ・ Simon Willison

Ornith-1.0とは?DeepReinforceが公開したMITライセンスのエージェント特化LLMを解説

DeepReinforceが2026年6月29日、Gemma 4とQwen 3.5をベースにしたエージェンティックコーディング向けLLM「Ornith-1.0」をMITライセンスで公開しました。9B〜397Bの4バリアントが揃い、同規模オープンモデルでコーディングベンチマークの最高水準を達成したとされます。

← タグ一覧へ