Inception выпустила диффузионную модель Mercury 2.5
Новая языковая модель рассчитана на поиск, RAG-системы, голосовых агентов и другие сценарии с множеством вызовов. По оценке Inception, она на 40% «интеллектуальнее» Mercury 2 и сопоставима с экономичными моделями GPT-5.6 Luna (Low), Gemini 3.5 Flash-Lite и Claude Haiku 4.5.
Компания заявляет скорость 1 107 токенов в секунду на распространённых GPU NVIDIA и контекст до 260 тысяч токенов. Базовая цена — $0,20 за миллион входных и $0,75 за миллион выходных токенов, но на старте действует скидка 80%: быстрее оказалась не только генерация, но и снижение тарифа.
В новости Tproger — заявленные возможности Mercury 2.5, цены и варианты доступа через Inception API, Baseten и OpenRouter.
Post #10687
813

- 🗿 2