Обычно новость про еще одну open source модель, которая бьет все бенчмарки, прилетает из Китая, но тут новость из США!
Вышла Ornith-1.0 — открытая LLM для agentic coding.
В линейке есть 9B, 31B, 35B MoE и 397B MoE. Старшая модель показывает очень сильные цифры:
77.5 в Terminal-Bench
82.4 в SWE-bench Verified
62.2 в SWE-bench Pro
78.9 в SWE-bench Multilingual
77.1 в ClawEval
Фишка в обучении: модель учат не только искать ответ, но и самой выстраивать план решения под задачу.
И все это под MIT лицензией, то есть можно использовать в коммерческих продуктах.
Похоже, в гонке open source моделей для кодинга США решили напомнить, что они тоже умеют. Похвально!
Детали:
https://deep-reinforce.com/ornith_1_0.html
и на хаггингфейсе https://huggingface.co/collections/deepreinforce-ai/ornith-10
Post #1868
5.93K

- 🔥 27
- ❤ 2
- 👍 1