Не доверяйте AI-агентам писать документацию
Ситуация: провёл ряд экспериментов, написали с агентами рабочий код, попросил задокументировать что работает, что нет, чтобы можно было воспроизводить эти результаты в будущем системно. Открыл эти документы почитать, а там куча фактических ошибок и галлюцинаций
Циклы «аудит→фикс→аудит→фикс» силами агентов не помогли. С этого момента стал все документы проверять вручную и обсуждать с агентом любой непонятный момент. А потом еще прогонять тесты: запускаю агентов, которых прошу воспроизвести решение по документам, а затем отдельный агент сверяет результат с исходником, который документировали. Это занимает время, но по такой документации потом можно нормально воспроизвести результат
Предполагаю, что огромный объём галлюцинаций в таких задачах связан с тем, что в обучающих данных модели таких текстов не было и быть не могло, поэтому при формировании каждого нового слова в документе элемент рандома выше обычного
Post #1288
1.39K
- 👍 4
- 🤔 4
- 🌚 1