Single Task Algorithmic Reasoning Models: маленькая модель против большой LLM — кто кого?
Коллеги уже показали, а мы и сами убедились: в 2026-м отличная reasoning-модель не вывезет на одних текстовых рассуждениях. Чтобы отвечать нормально на большинство вопросов, ей нужны инструменты, мультимодальные рассуждения, а порой и вовсе экзотика вроде рассуждений в латентных представлениях сети.
И ещё: завезли фреймворк STARM для обучения рекурсивных reasoning-моделей. Он заметно уделывает по качеству все предыдущие open source аналоги.
Читать далее
👉 Data Science | Machinelearning [ru]
Post #5818
1.71K

- ❤ 1