Посмотрели видео? Впечатляет скорость? А на необычное "собирание" текста обратили внимание?
Inception Labs выпустил самую быструю и причем рассуждающую LLM!
Модель Mercury 2 основана на диффузионной архитектуре. То есть она генерирует все токены сразу параллельно, а не последовательно токен за токеном как в обычных нейросетях.
Модель также имеет выход в интернет. Правда пока функция глючит - работает через раз, а то и реже.
Потестировать можете тут. VPN не нужен.Делитесь постом с коллегами, которые также интересуются нейросетями.