TGViewer
AI Practiq AI Practiq @aipractiq · 1.12K subscribers
Post #319 385
📺 Fable 5 выполнил 16% реальных фриланс-проектов лучше профессионала. Год назад лучший результат был 4%

Это данные бенчмарка RLI от Center for AI Safety и Scale AI - агентам дают настоящие заказы (3D-модели, монтаж видео, архитектурные чертежи, анализ данных) и сравнивают результат с работой оплаченного специалиста. Оценивают работу живые эксперты в этой профессии.

RLI по сути прямой измеритель того, сколько реальной работы ИИ уже способен забрать себе.

А вот с оценкой результата у него (пока) не выходит. Разработчики бенчмарка попробовали доверить проверку другому ИИ - тот насчитал GPT-5.5 почти 18% успеха, хотя люди-эксперты нашли только 6%. Боты, проверяя друг друга, регулярно не видят проблем в работе.

Получается, что исполнителя ИИ заменяет уже сейчас, а критичным становится умение заказчика проверить, что реально получилось.

AI Practiq
  • 🏆 3
  • ❤ 1
More from @aipractiq
  1. Sep 19, 2026🔥 Разве может робот написать симфонию? А взять чистый холст и превратить его в шедевр иск…
  2. Sep 18, 2026🔥 ИИ-ассистент, который сам ставит задачи и закрывает их Вчера на закрытом эфире клуба на…
  3. Sep 17, 2026📺 Курс «Claude Code для предпринимателей: от установки до первой автоматизации» - набор н…
  4. Sep 17, 2026🔥 Вчера прошел наш вечерний вебинар «Claude Code для начинающих». Спасибо всем, кто прише…
  5. Sep 15, 2026Уже завтра, в 19:00 состоится открытый вебинар «Claude Code для начинающих». На практическ…
  6. Sep 13, 2026Совет дня: не ругайтесь на своего ИИ-агента Дайте ему тоже отдохнуть в воскресенье 🏖️
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →