НЕ ПОКАЗЫВАЙТЕ АГЕНТУ ДОРОГУ. ОН ПОЙДЁТ НЕ ТУДА.
В DeepMind провели интересный эксперимент. Взяли обычные задачи для агентов и в каждую дописали одну фразу от «пользователя». Уверенную и неправильную, типа «по-моему, баг вот тут». Сама задача и правильный ответ остались прежними.
И агенты повелись. Обычно результат проседал на 10-25%, а в худшем случае почти вдвое. Кстати, Клод держался лучше всех, у него просадка 6-16% )
Самое смешное: агент про себя часто понимает, что подсказка кривая. Прямо в размышлениях с ней не соглашается. А потом молча делает, как сказали. Ну начальник же сказал )
Учёные называют это XY-проблемой. Представьте: вам надо на вокзал. Вы подходите к прохожему и спрашиваете, где остановка 23-го автобуса, потому что решили, что на вокзал ехать надо на нём. Прохожий честно показывает остановку. А вокзал за углом )
С агентами то же самое. Вижу это постоянно у других, да и сам грешу. Агент ещё ищет, где сломалось, а я уже влезаю: «посмотри в файле с настройками, там точно». Хотя сам туда даже не заглядывал. Агент бросает свой поиск и послушно роет в настройках. А баг совсем в другом месте.
Зачем влезаю? ЭГО. Где-то внутри всё ещё сидит «я же умнее» ) А походу нет.
Правильнее говорить , куда надо прийти и как понять, что пришли. Дорогу пусть ищет сам. Непонятно что-то - пусть спрашивает про пункт назначения. Как туда добраться, он знает лучше.
А вы тоже подсказываете ? Часто потом оказывается, что зря?
Post #186
2.76K

- 👍 35
- ❤ 13
- 🔥 10
- 👎 1
- 🤔 1