Даже лучшие LLM повреждают 25% содержимого ваших документов — и вы этого не замечаете.
Новое исследование проверило 19 языковых моделей в режиме делегирования: когда ИИ получает задачу и работает с документом самостоятельно. Результат неприятный: топовые модели к концу длинного рабочего сеанса в среднем портят каждый четвёртый фрагмент контента. Ошибки редкие, но серьёзные — и именно поэтому незаметные.
Чем длиннее сессия, чем больше документ и чем больше посторонних файлов рядом — тем хуже. Агентные инструменты проблему не решают. Модель просто тихо накапливает повреждения.
Это не повод отказываться от ИИ-помощников. Это повод выстроить проверку: короткие итерации, явные инструкции, финальный ревью человеком. ИИ — исполнитель, а не редактор с правом последнего слова. ☑️
Разбираем ИИ-инструменты для бизнеса →
ИИ Инструменты | Контент-завод | База знаний
Post #63
40
