⭐️ Google выпустил три модели Flash: 3.6 Flash, 3.5 Flash-Lite и 3.5 Flash Cyber
3.6 Flash — рабочая лошадка линейки. По данным Google на 17% меньше выходных токенов на задачу, чем у 3.5 Flash.
3.5 Flash-Lite — самая быстрая и предзначена для тех кому нужен быстрый ответ: 350 токенов в секунду. По собственным бенчам Google, по качеству обгоняет даже 3 Flash на части агентных задач.
⚠️ 3.5 Flash Cyber (поиск и патч уязвимостей) публично не доступна только правительствам и «доверенным партнёрам» в закрытом пилоте, что уже становится трендом. И это не разовая история — у крупных вендоров всё чаще самые мощные и специализированные модели закрываются от обычных разработчиков сразу на старте, а не спустя время после релиза. Тенденция, за которой стоит следить отдельно от самих моделей.
Бенчмаркам на анонсе я доверяю слабо в принципе, и это касается не только Google: любой вендор на релизе подбирает цифры так, чтобы показать себя с лучшей стороны.
Главный вопрос качество/цена работы а не цена за токены в отрыве от скорости и качества.
Я это уже проходил с GLM 5.2 недавно: дешёвый токен ничего не гарантирует, если модель тратит их в разы больше на ту же задачу, и итоговая стоимость решения оказывается выше, чем у дорогой, но эффективной модели. Смотреть надо на стоимость выполнения задачи целиком, а не на прайс-лист за 1M токенов.
3.6 Flash и Flash-Lite уже можно пробовать в Android Studio через Gemini API и оценить на ваших задачах.
#AI #Gemini #LLM
Post #211
2.25K

- 👍 5
- 👎 4