🌺 Релиз Ornith-1.0 - новое семейство open-source LLM, специализированных под agentic coding.
Ornith-1.0 выходит в разных размерах:
• 9B Dense
• 31B Dense
• 35B MoE
• 397B MoE
Модели показывают state-of-the-art результаты среди open-source моделей сопоставимого размера на coding-бенчмарках:
• Terminal-Bench 2.1 — 77.5
• SWE-Bench — 82.4 на verified, 62.2 на pro, 78.9 на Multilingual
• NL2Repo — 48.2
• SWE Atlas — 41.2 на QnA, 42.6 RF, 39.1 TW
• ClawEval — 77.1
Ornith-1.0 дообучали поверх Gemma 4 и Qwen 3.5.
Reinforcement learning используется не только для генерации решений, но и для создания task-specific scaffolds, которые направляют эти решения.
То есть модель совместно улучшает и «каркас» задачи, и итоговое решение. За счёт этого она генерирует более качественные ответы в agentic coding.
Все модели выпущены под MIT-лицензией, поэтому их можно использовать и в коммерческих, и в исследовательских проектах.
📖Tech Blog: http://deep-reinforce.com/ornith_1_0.html
🤗Huggingface: http://huggingface.co/collections/deepreinforce-ai/ornith-10
Post #5372
4.91K

- ❤ 8
- 👍 5
- 🥱 2
- 🔥 1