Google DeepMind только что ускорил Gemma 4 в 3 раза
Сегодня Google DeepMind выкатил Multi-Token Prediction для Gemma 4: модель предсказывает сразу несколько токенов вперёд, а основная сеть проверяет параллельно. Результат — до 3.1x быстрее на Pixel TPU и 3x на A100. Всё open-source (Apache 2.0), размерки 2B и 4B идеально летают на edge-устройствах.
Параллельно CopilotKit поднял $27 млн — теперь любой разработчик может встраивать нативных AI-агентов прямо в приложение за пару строк кода. Без своих серверов, без головной боли с контекстом и памятью.
Кто уже пробует Gemma 4 + новые агенты — пишите в комментах, какой прирост по скорости и качеству получили. А кто ещё на старых моделях — сейчас самое время мигрировать, пока все не ушли вперёд.
#Gemma4 #AIDev #MultiTokenPrediction #CopilotKit #FutureOfCoding
Post #425
56

- ❤ 3