Вышел локальный ИИ на стероидах
Кажется, греть комнату огромными 70B-моделями скоро станет моветоном. Google выкатила Gemma 4, и её 31B-версия уже бьет тяжеловесов.
DeepMind дропнули 4 поколение открытых моделей (лицензия Apache 2.0).
Что под капотом:
→ Архитектура MoE: 26B-модель активирует всего 3.8B параметров при инференсе. Летает быстро и без деградации знаний.
→ Агенты из коробки: Завезли нативную поддержку вызова функций и структурированного вывода в JSON.
→ Мультимодальность: Модели едят картинки и видео (контекст до 256k). Младшие E2B и E4B вдобавок понимают аудио, работая полностью офлайн на смартфонах и Edge-девайсах.
Старшая 31B Dense уже ворвалась в топ-3 Arena AI Text среди опенсорса, при этом спокойно влезая на одну GPU. Эра мощного суверенного ИИ без боли с задержками официально стартовала.
#LLM #GenAI #AIAgents
Google DeepMind
Post #346
67

- ❤ 3