TGViewer
CODE BLOG CODE BLOG @codeblog · 10.5K subscribers
Post #7645 1.87K
Google выпустила Gemini 3.1 Pro

В бенчмарке ARC-AGI-2, который проверяет способность решать незнакомые логические головоломки (а не просто вспоминать заученное), нейросеть набрала 77,1%. Для сравнения: средний результат человека в этом тесте около 60%. Предыдущая версия, вышедшая всего три месяца назад, показывала скромные 31,1%, так что скачок производительности произошел колоссальный.

В таблице лидеров новинка подвинула основных конкурентов. Gemini 3.1 Pro обходит GPT-5.2, Opus 4.6 и Sonnet 4.6 в большинстве дисциплин, от научных знаний уровня PhD до спортивного программирования. Отставание есть лишь в узкоспециализированных задачах, вроде работы с терминалом.
  • 👍 2
  • 👎 1
More from @codeblog
  1. Apr 10, 2026Когда придумал как фиксануть баг, но комп лень включать
  2. Apr 10, 2026Пушистый файрвол спас квартиру от пожара Пока инженеры Nvidia годами не могут решить пробл…
  3. Apr 10, 2026Как уплачено, так и . . .
  4. Apr 10, 2026Энтузиаст собрал PlayStation One на стероидах Моддер под ником Secret Hobbyist собрал ульт…
  5. Apr 9, 2026Первый раз мама была неправа
  6. Apr 9, 2026Иронично, но браузер от Google стал одним из последних на Chromium, где этот функционал до…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →