«Яндекс» впервые обучил с нуля собственную большую языковую модель Alice AI Foundation LLM и открыл её веса для разработчиков.
В модели 80 млрд параметров, из которых одновременно активны 3 млрд, а обучение прошло на 18 трлн токенов. В дальнейшем она должна стать фундаментом для рассуждающих моделей и ИИ-агентов «Алисы».
Здесь важен именно переход к собственной фундаментальной модели. Раньше вокруг «Яндекса» шли споры о том, насколько его решения зависят от дообучения иностранных разработок, в частности китайских Qwen. Теперь компания заявляет о полном цикле обучения с нуля, а открытые веса позволяют отечественным разработчикам брать эту основу и создавать на ней собственные коммерческие продукты.
Конечно, не стоит делать вид, что Россия таким образом уже догнала США или Китай. 80 млрд параметров — сравнительно компактная модель, тогда как мировая гонка идёт вокруг систем значительно большего масштаба, а бюджеты на ИИ-инфраструктуру у крупнейших американских корпораций исчисляются сотнями миллиардов долларов. Именно поэтому соревноваться в лоб по объёму вычислений нам чрезвычайно сложно.
Но это не означает, что заниматься собственными моделями бессмысленно. Наоборот, в условиях такого разрыва особенно важно иметь независимую технологическую базу хотя бы для тех задач, где отечественному бизнесу и государству не требуется абсолютный мировой максимум качества.
Константин Двинский. Подписаться.
Post #15661
1.51K
- 👍 46
- 🤔 5
- ❤ 4
- 💯 3