TGViewer
PRO продукты и системы | Иннокентий Бодров PRO продукты и системы | Иннокентий Бодров @spherical_analyst · 2.62K subscribers
Post #1225 439
Одна из самых частых ошибок при работе с LLM выглядит примерно так.

Вы просите модель написать код.
Потом, не меняя контекст, говорите: «А теперь проверь, всё ли здесь правильно.»
Она находит пару мелких замечаний, что-то косметически поправляет и в итоге говорит: «В целом решение корректное.»

Честно говоря, было бы странно ожидать другого.

Модель не перечитывает код «свежим взглядом». Она продолжает тот же разговор, в котором уже построила гипотезу, что это решение хорошее. Проверка превращается не в независимое ревью, а в продолжение собственной цепочки рассуждений.
Я столкнулся с этим, когда гонял локальные модели на собственном харнессе. Я проверял их на десяти сценариях, и долго не мог понять, почему результаты выглядят прилично, а реальной работы почти нет.

Ответ оказался неприятно простым.

Модель сначала генерировала решение, а потом сама же его подтверждала.
После разделения контекстов качество выросло заметно.
Теперь одна роль только строит решение и вообще ничего не знает о том, что его потом будут проверять. Вторая получает только готовый результат и задачу его сломать. Без истории диалога, без объяснений, без «я уже думал над этим». Третья вообще работает отдельно — она смотрит только на источники и пытается найти противоречия между ними и тем, что получилось.

И здесь, как мне кажется, важен один момент.

Это не история про дорогие агентные платформы.
Это можно сделать даже тремя отдельными окнами ChatGPT, если у каждого будет своя роль и свой контекст.
Чем независимее эти роли друг от друга, тем больше шансов, что одна действительно поймает ошибку другой.

Попробуйте вспомнить свою последнюю задачу.

Сколько раз вы просили модель проверить то, что она сама только что и написала?
  • 💯 5
  • 👍 2
More from @spherical_analyst
  1. Oct 2, 2026​​Уважаемые коллеги, всем хорошей пятницы! Мы тоже отлично поработали — и с радостью объяв…
  2. Oct 2, 2026Кажется, я нашёл один из лучших способов проверить свой английский. И это не экзамен и не…
  3. Oct 1, 2026Вчера сходил на SBC Summit в Лиссабоне и несколько раз ловил себя на мысли: а я точно в По…
  4. Sep 29, 2026Пять проверок: перед вами AI-инструмент или уже рабочий контур? Последнее время вижу много…
  5. Sep 28, 2026Post #1268
  6. Sep 25, 2026Post #1265
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →