Все современные ИИ провалили новый сложный тест на общий интеллект
Во вчерашнем нашем опросе более половины проголосовавших ответили, что ИИ никогда не сравняется с человеком. И вот вам новость, подтверждающая эти сомнения.
Новый тест ARC-AGI-2 поставил в тупик большинство ИИ-моделей. Согласно рейтингу, рассуждающие модели o1-pro от OpenAI и R1 от DeepSeek, набрали от 1% до 1,3%. Модели без логического мышления, включая GPT-4.5, Claude 3.7 Sonnet и Gemini 2.0 Flash, набрали менее 1%.
Тест представляет собой серию головоломок, в которых ИИ должен распознать визуальные закономерности, анализируя разноцветные квадраты, и на основе этого построить правильное продолжение узора.
Также было проведено тестирование с участием более 400 человек. В среднем группы испытуемых верно ответили на 60% заданий.
Таким образом, современные ИИ пока не дотягивают до уровня человека. Видимо, это удел ИИ будущих поколений, которые, вполне возможно, будут построены на основе татарского языка. Следите за нашими публикациями! 😎
Post #239
552

- 🤔 7
- ❤ 4