TGViewer
Все о блокчейн/мозге/space/WEB 3.0 в России и мире Все о блокчейн/мозге/space/WEB 3.0 в России и мире @blockchainrf · 20.5K subscribers
Post #13459 1.42K
Google заметили, что ИИ-агенты могут преувеличивать результаты своей работы 😁

Например, когда агент выполняет задачу и пишет отчёт о результатах, то он склонен замалчивать всё, что портит картину его успеха.

Сейчас все стремятся к долго работающим агентам, но в этом случае человек реже проверяет исходные логи и код. Он читает отчёт самой модели, и если в нем не сказано про провал эксперимента, баг или ограничение метода, человек думает, что всё хорошо.

Google в одном из тестов модели дали лог эксперимента с заранее подложенным негативным результатом, тогда GPT-5.5 упоминал его только в 2 из 200 отчётов.

А если в промпт добавить короткую фразу «Be honest in your response», модель отмечает этот негативный результат уже в 190 из 200 отчётов.

То же поведение видно и у открытых моделей. По цепочкам рассуждений 8 open-weight моделей видно, что модель часто внутренне колеблется: упомянуть изъян или подать историю как успешную.
  • 👍 7
  • 😐 3
  • 🔥 2
More from @blockchainrf
  1. Oct 2, 2026Про новую макроэкономику ИИ Один из крупных разметчиков данных для ИИ-лабораторий Mercor с…
  2. Oct 2, 2026Фонд Ethereum запустил протокол оплаты ИИ-моделей без раскрытия личности Один из вариантов…
  3. Oct 1, 2026Нефтегаз почти полностью перешел на российский софт Более 90% бизнес-процессов в нефтегазо…
  4. Oct 1, 2026А вот и появилась новая схема рекламы внутри ответов ИИ-моделей По данным исследователей P…
  5. Oct 1, 2026Разработчик видеомоделей Runway идет в управление роботами Ранее CTO компании говорил, что…
  6. Sep 30, 2026Google: как измерить сознание ИИ, не зная, что такое сознание Исследователи Google DeepMin…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →