Скайнет застрял в текстурах
Дата-центры сжигают мегаватты, но пасуют перед пиксельной головоломкой. В новом тесте GPT-5.4 набрал 0,26%, а обычные «кожаные мешки» — 100%.
Франсуа Шолле выкатил бенчмарк ARC-AGI-3. Раньше нейронки тупо зазубривали ответы, поэтому теперь всё интерактивно: 135 сред размером 64х64 пикселя. Никаких текстовых инструкций, нужно вслепую искать скрытые механики.
→ Gemini 3.1 Pro и Grok-4.20 тоже рухнули ниже 1%.
→ Штрафы квадратичные: ИИ со 100 шагами вместо 10 эталонных получает лишь 1% эффективности.
→ Агенты-костыли не спасают: 97% успеха в одной игре превращаются в 0% в следующей.
Обычный человек щёлкает такие задачи за 7,4 минуты вообще без подготовки. Кажется, настоящий AGI пока откладывается.
Верите в скорое появление AGI?
🔥 Конечно, GPT-6 всё исправит
🥶Это тупиковая ветвь, LLM — просто умные Т9
😜Я просто пишу микросервисы, мне норм
#AI #LLM #GenAI
(источник)
Post #328
57

- ❤ 4
- ☃ 1