Inception выпустила Mercury 2.5 в релиз, превью разбирал неделю назад. Цифры те же: диффузионная модель пишет текст блоками параллельно, 1107 токенов в секунду на обычных NVIDIA GPU, плюс 40% к интеллекту к Mercury 2, контекст 260K, уровень GPT-5.6 Luna на низком усилии и Haiku 4.5. По словам Inception, это самая большая диффузионная LLM из обученных.
Из нового в анонсе только кейсы клиентов, которые уже гоняют модель в проде. Augment Code перевела на Mercury сжатие контекста, маршрутизацию и поиск MCP-инструментов: сжатие ускорилось со 150 секунд до 27, цена упала на 90%. У OpenCall с голосовыми агентами медиана ответа модели около 170 мс. Рядом превью Mercury Voice с первым токеном быстрее 170 мс и Mercury Router, который читает запрос и раскидывает по чужим моделям.
Цена $0,20 за млн входных и $0,75 за выходные, на старте скидка 80%: $0,04 и $0,15. Есть в API Inception, на OpenRouter и Baseten, новым аккаунтам дают 100 млн токенов. Следующая модель уже обучается, обещают крупнее и в ближайшие месяцы.
В ролике модель собирает веб-приложение по паре промптов.
@neuro_channel
Post #2856
2.1K
- ❤ 3