Вышла Gemma 4 — локальная модель от Google. Поставил на свой Mac Studio.
Первый вопрос, который я всегда задаю всем новым локальным моделям: «Что ты умеешь?».
Мне это нужно, чтобы увидеть скорость инференса (генерации ответа) и насколько модель отвечает адекватно и живо.
Gemma 4 — первая локальная модель, которая сказала не только что умеет, но и чего не умеет: физические действия, эмоции и сознание, стопроцентная точность.
Большинство локальных моделей в ответ на "что ты умеешь" выдают маркетинговый список.
А тут — честность про галлюцинации и ограничения. Мне даже показалось с намеком на юмор. Ведь физические ограничения и так очевидны)
Тест пройден — зачёт.
Скорость — 6.59 токенов/с.
Медленно, для реальной работы пока не годится.
Жду, когда портируют под новый MLX в Ollama.
Post #524
2.58K

- 🔥 12
- 👍 6
- ❤ 3