Qwen 3.8 27B - это параноик из мира LLM
Я просматривал reasoning Qwen 3.8 27B и заметил, что она постоянно сомневается в себе.
Она приходит к решению, затем начинает его перепроверять, рассматривает другие варианты, возвращается назад и снова всё проверяет.
Похоже, именно поэтому относительно небольшая 27B-модель способна показывать настолько хорошие результаты.
На xhigh reasoning effort это особенно заметно. Иногда кажется, что модель уже закончила рассуждать и сейчас даст финальный ответ, но затем она снова начинает всё перепроверять.
Это делает её медленнее и заставляет расходовать намного больше thinking-токенов, но для сложных задач такой подход может быть преимуществом.
Взял из реддита, ибо мне зашел такой вариант описания поведения модели 🙂
А вы что думаете?
Post #142
1.86K
- 👍 21
- ❤ 6