Google выпустила семейство открытых моделей Gemma 4 из пяти размеров
Google DeepMind завершила линейку Gemma 4: пять размеров от E2B для смартфонов до 31B Dense для рабочих станций, лицензия Apache 2.0. Флагманский 26B A4B на архитектуре MoE активирует лишь ~4B параметров на токен и требует 14,4 ГБ в квантовании Q4.
- Пять размеров: E2B, E4B, 12B Unified, 26B A4B и 31B Dense
- 26B A4B активирует ~4B параметров на токен при 14,4 ГБ в Q4
- 31B Dense: MMLU Pro 85,2, AIME 2026 — 89,2, LiveCodeBench v6 — 80,0
- 12B Unified без отдельного энкодера обрабатывает текст, изображения и звук
Читать дальше
ИИ