Google выпустила Gemini 3.1 Pro
В бенчмарке ARC-AGI-2, который проверяет способность решать незнакомые логические головоломки (а не просто вспоминать заученное), нейросеть набрала 77,1%. Для сравнения: средний результат человека в этом тесте около 60%. Предыдущая версия, вышедшая всего три месяца назад, показывала скромные 31,1%, так что скачок производительности произошел колоссальный.
В таблице лидеров новинка подвинула основных конкурентов. Gemini 3.1 Pro обходит GPT-5.2, Opus 4.6 и Sonnet 4.6 в большинстве дисциплин, от научных знаний уровня PhD до спортивного программирования. Отставание есть лишь в узкоспециализированных задачах, вроде работы с терминалом.
Post #7645
1.87K

- 👍 2
- 👎 1