GPT-5.2 превзошла человека в тесте на бенчмарке ARC-AGI-2
Команда из шести бывших сотрудников Google DeepMind создала систему, которая превзошла человека в тесте на общий искусственный интеллект
Их стартап Poetiq показал результат 75 % на бенчмарке ARC-AGI-2
Для сравнения - люди в среднем решают 60 % задач этого теста
Система работает на основе модели GPT-5.2 X-High от OpenAI
Решение одной задачи обходится меньше чем в $8
Это на 15 процентных пунктов лучше, чем у прежнего лидера - той же GPT-5.2 X-High, но без дополнительной обработки
Post #340
74
Forwarded from ARI AML
- 💩 1