Стартап Paradigma опубликовал свою первую модель, Limite Violetto на 1 млрд параметров с контекстом до 131 тысячи токенов, рассчитанную только на решение математических задач.
Violetto разработана с максимально упрощенной настройкой инструкций, чтобы опровергнуть предположение о необходимости внедрения моделей в вспомогательный интерфейс для их эффективной работы. Поэтому она отвечает в один ход (задача на входе, решение на выходе) и ведёт себя не как чат-бот.
На вопросы вне математики модель часто переосмысляет их как математическую задачу.
Например, на просьбу простыми словами объяснить фотосинтез она начала рассуждать о том, как клетка делится на две, а те снова делятся.
Вторая модель, Limite Value Model решения оценивает. Она получает задачу и предложенное решение и для каждого токена ответа выдаёт оценку того, насколько рассуждение до этой точки ведёт к верному ответу.
С ней можно ранжировать несколько кандидатов или использовать модель в обучении с подкреплением.
Авторы предупреждают, что это регрессионные оценки и доказательства модель не проверяет. На полном контексте ей хватает 7,5 Гб видеопамяти.
🟡Тесты
Часть цифр конкурентов Paradigma взяла из их карточек или с MathArena.
На AIME 2026 Violetto набрала 94,01%. Такой же результат показывают Nemotron 3 Super, Qwen3.5 9B и VibeThinker 3B.
На BeyondAIME у Violetto 74,25% против 70% у MUSE-Glimmer-30B.
Запустить модель пока можно только через плагин Paradigma для vLLM 0.26.0 на Linux с видеокартой NVIDIA и драйвером с поддержкой CUDA 13.0. Поддержку Transformers обещают позже.
📌Лицензирование: Apache 2.0
🟡Блогпост
🟡Веса
🖥Github
@ai_machinelearning_big_data
#AI #ML #SLM #Violetto #Paradigma
