TGViewer
Все о блокчейн/мозге/space/WEB 3.0 в России и мире Все о блокчейн/мозге/space/WEB 3.0 в России и мире @blockchainrf · 20.5K subscribers
Post #13175 2.65K
Про harness от ex-OpenAI: фронтир сейчас не в архитектуре ИИ-агента, а в архитектуре оценки агента.

Эту работу написала Лилиан Вэнг, ex- Head of Safety Research в OpenAI. Сейчас она работает в Thinking Machines.

Лилиан пишет, что между обычной ИИ-моделью и реальным миром существует слой - харнесс - это система вокруг базовой модели, которая оркестрирует исполнение: как модель думает и планирует, вызывает инструменты, управляет контекстом, хранит артефакты и оценивает результаты.

Она считает, что этот слой не менее важен, чем сырые веса модели, и именно через него в ближайшие годы будет идти рекурсивное самосовершенствование ИИ.

Лилиан упоминает Claude Code как один из примеров состоявшегося харнесса и прогнозирует, что в краткосрочной перспективе RSI пойдёт не через переписывание весов моделью, а через эволюцию харнесса.

Она считает основной проблемой то, что агент улучшает то, что можно измерить. Если метрика кривая, он научится обманывать метрику, а не решать задачу лучше.
И пока никто не придумал, как надёжно измерить глубину рассуждения или научную ценность идеи - петля самосовершенствования упирается именно в это.

Получается, самое сложное сейчас не построить агента, который улучшает себя, а построить оценщика, которого нельзя обмануть.

Реальный фронтир - не как агент работает, а как мы понимаем, что он стал лучше.
lilianweng.github.io Harness Engineering for Self-Improvement The concept of recursive self-improvement (RSI) dates back to I. J. Good (1965), where he defined an “ultraintelligent machine” as a system that can surpass humans in all intellectual activities and design better machines to improve itself. Yudkowsky (2008)…
  • ❤ 7
  • 🦄 4
  • 🥰 2
  • 🔥 1
More from @blockchainrf
  1. Oct 4, 2026Итоги уходящей недели - то, что имеет значение Бизнес ИИ- компаний Карта рынка ИИ в клиент…
  2. Oct 2, 2026Ого! Neuralink обучил ИИ на 50 000 часах сигналов мозга пациентов, которым вживили имплант…
  3. Oct 2, 2026В Meta предложили мета-рассуждение для агентов Это способ управлять самим ходом работы аге…
  4. Oct 2, 2026Про новую макроэкономику ИИ Один из крупных разметчиков данных для ИИ-лабораторий Mercor с…
  5. Oct 2, 2026Фонд Ethereum запустил протокол оплаты ИИ-моделей без раскрытия личности Один из вариантов…
  6. Oct 1, 2026Google заметили, что ИИ-агенты могут преувеличивать результаты своей работы 😁 Например, к…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →