「Gemma 4」のメモリ消費を大幅削減する「QAT」、品質はそのままスマホ上でも十分動作/最小の「E2B」は約1GB、最大の「31B」も1/4にまでメモリ削減

 米Google DeepMindは6月5日(現地時間)、オープンモデル「Gemma 4」ファミリーの「Quantization-Aware Training」(QAT)チェックポイントを公開した。メモリ使用量を大幅に削減しつつ、モデルの品質を保つことを狙ったもので、「E2B」「E4B」「12B」「26B MoE」「31B」の全モデルが対象。