🤖 AI-Дайджест: 7 сентября 2026 🧪
🔬 OpenAI показала, как агенты меняют работу её исследователей
В отчёте от 6 сентября компания заявила, что достигла уровня «AI-стажёра»: система выполняет чётко заданные исследовательские задачи под руководством человека, включая задачи на несколько дней.
По внутренним данным за август, на один рабочий день человека приходилось 3,1 дня работы агентов. Это время выполнения, а не доказанное ускорение науки в 3,1 раза. Более половины успешных задач длительностью 4–8 часов за последние полгода требовали вмешательства человека.
Практический вывод: делегировать можно более длинные задачи, но контрольные точки и проверку результата рано убирать. источник
🔎 OpenAI: следить за рассуждениями сильных моделей становится труднее
6 сентября главный научный сотрудник OpenAI Якуб Пахоцкий сообщил: внутренние оценки показывают снижение надёжности мониторинга цепочек рассуждений. Среди причин — смешение рассуждений с инструментами и общением, а также рост способностей моделей решать задачи без словесного рассуждения.
Это не анонс нового защитного инструмента, а признание ограничения существующего подхода. Вывод для работы с агентами: убедительное объяснение действий не заменяет проверку самих действий и ограничение доступов. источник
Post #110
5