Яндекс выложил в опенсорс свою новую ИИ-модель, обученную с нуля
Яндекс выложил в опенсорс Alice AI Foundation LLM — претрейн-версию своей новой суверенной большой языковой модели, обученной полностью с нуля.
Alice AI Foundation стала более крупной и универсальной разработкой: она содержит 80 млрд параметров, из которых активны 3 млрд, и обучена на 18 трлн токенов. Модель должна стать основой будущей рассуждающей модели компании и агентных возможностей «Алисы AI».
Суверенная LLM показывает высокие результаты в программировании и способности к рассуждениям, а по качеству ответов на русском языке превосходит многие мировые аналоги:
▶️ на олимпиадных задачах по математике она делит лидерство с Qwen3.5-35B-A3B-Base;
▶️ в тестах на написание кода превосходит модель компании NVIDIA Nemotron-3-Super-120B-Base;
▶️ обходит на задачах, где нужны широкие фактические знания DeepSeek-V4-Flash-Base.
Добиться таких успехов разработчикам Яндекса удалось за счет:
▶️ Улучшения работы оптимизатора — его перестроили так, чтобы пересылка данных между видеокартами шла параллельно с вычислениями.
▶️ Оптимизации подготовки качественных обучающих данных — теперь перед такой оценкой документы проходят через каскад классификаторов. Это позволило в десятки раз сократить количество вычислений и при этом сохранить около 95% полезных документов.
Новая модель предоставляется под лицензией Apache 2.0, что позволяет свободно использовать её в коммерческих и исследовательских целях. Она уже прошла основной этап обучения, от которого зависят её эрудированность, способности и потенциал. Это позволяет использовать её как основу для создания собственных проектов📌
💻 СофтТех в Telegram | в MAX
Post #4791
2.38K
