«Яндекс» выложил в опенсорс модель, которой не существовало по версии Грефа
▶️ В open source стало на одну большую языковую модель больше. «Яндекс» выложил в Alice AI Foundation LLM - претрейн-версию новой LLM, обученной полностью с нуля. Модель доступна под свободной лицензией Apache 2.0, а значит, её можно использовать и в исследовательских, и в коммерческих проектах.
«Яндекс» называет модель экспериментальной базой для будущей единой рассуждающей модели (ЕРМ), которая ляжет в основу агентных возможностей Алисы AI. Проще говоря, на этой архитектуре компания тестирует решения, которые позже позволят Алисе выполнять конкретные действия по поручению пользователя.
Что умеет модель по заявлениям «Яндекса»:
⏺️ сильна в рассуждениях и программировании.
⏺️ на олимпиадных задачах по математике делит лидерство с Qwen3.5-35B-A3B-Base.
⏺️ в коде обходит NVIDIA Nemotron-3-Super-120B-Base, используя в 4 раза меньше активных параметров.
⏺️ по фактическим знаниям обходит DeepSeek-V4-Flash-Base (284 млрд / 13 млрд активных) и выходит на уровень предыдущей закрытой Alice AI LLM, у которой в 3 раза больше параметров и в 7 раз больше активных.
Пару месяцев назад глава Сбербанка Герман Греф заявил в Совфеде, что «Яндекс» не создаёт собственные языковые модели с нуля, а лишь дообучает китайскую нейросеть Qwen от компании Alibaba. По его утверждению, полностью самостоятельный продукт в сфере искусственного интеллекта в России есть только у Сбера.
🔼 «Яндекс» тогда оперативно опроверг эти слова, заявив, что «продолжает развивать собственные фундаментальные модели, сохраняет полный цикл разработки и не зависит от внешних решений». Видимо, релиз можно воспринимать еще и как прямое техническое опровержение заявления Грефа.
™ МашТех в Telegram | в MAX
Post #6927
7.67K
