Свежее небольшое исследование Этана Моллика и ко по эффективности Chain-of-Thought prompting — техники промтинга, заставлюящую большие языковые модели «думать пошагово».
TLDR: для старых моделей подход немного улучшает выдачу, однако увеличивает вариативность ответов и повышает вероятность ошибки там, где без этого подхода модель ответила бы верно.
Для «думающих» моделей, техника почти ничего не дает, при этом увеличивая время и требуемое количество токенов (и, соответственно, стоимость, если работать через API).
Post #172
195