Сжатые примеры в промпте экономят не только токены. Они срезают точность ниже, чем если бы примеров не было вовсе.
Замер из работы MPI for Intelligent Systems, ELLIS Institute Tübingen и ETH Zürich. Модель на 5 миллиардов параметров, задачи MathCAMPS, три few-shot примера в трёх форматах записи. Вопросы во всех вариантах одни и те же, отличается только стиль решения.
Без примеров — 34,0%. Те же примеры рукописной прозой, в среднем 374 символа, — 36,8%. Сжатой алгебраической записью, 99 символов, — 17,0%. Голой парой «вопрос — ответ», 41 символ, — 9,2%. Дословно у авторов: «only natural-prose shots improve over the zero-shot direct baseline; every other format strictly hurts».
Промпт, ужатый ради контекстного окна, — это не тот же промпт короче.
https://arxiv.org/abs/2608.13545
Post #849
287