Naive-N0.5-Flash от NaiveAI
Модель для кодинга и AI-исследований: 309B параметров MoE при 15.5B активных. Нативный контекст в 1 млн токенов без полного внимания - гибрид скользящего окна и разреженного внимания DSA от DeepSeek
• 1M контекста целиком
• до 2000 токенов/сек в режиме Ultrafast через свою систему NaiveRT
• 50 токенов/сек на юзера в стандартном режиме
• построена на базе Xiaomi MiMo-V2.5, дообучена на 3.25T токенов
• веса под MIT, FP8
• API: $0.10 вход / $0.40 выход / $0.01 кэш за миллион токенов
Только NVIDIA с FP8, веса ~315 ГБ
Гитхаб
HF
Спасибо @m_franz
#flagship #coding
MAX
Post #14814
846


- 👍 6