Хоть это и не Pro-версия, но цифры все равно приятные очень даже:
• Код (Terminal-Bench 2.1): 76.2% vs 70.3% у Gemini 3.1 Pro
• Агентские задачи (GDPval-AA): 1656 vs 1314
• Работа с инструментами (MCP Atlas): 83.6% vs 78.2%
Flash обошла предыдущий флагман по всем трём направлениям. Это значит: генерация кода стала точнее, а сложные многошаговые задачи, когда ИИ сам планирует и выполняет действия, — резко выросли в качестве.
Модель уже катят на всех пользователей Gemini и в поиск Google. Omni тоже будет доступна всем. Кайфы 😮
@creativethecreator
