✔️ Tencent представила диффузионную языковую модель: в 6 раз быстрее классических LLM
WeDLM-8B Instruct использует не авторегрессию, как обычные LLM,
а диффузионный способ генерации текста.
Что это даёт?
🚀 В задачах математического рассуждения модель работает в 3–6 раз быстрее,
чем Qwen3-8B даже с оптимизациями vLLM - при сохранении качества.
Этот релиз ломает старый миф, что «диффузионные модели не подходят для точных текстовых задач».
На практике WeDLM показывает, что такой подход может конкурировать
и даже обходить трансформеры по скорости инференса.
Модель открыта и доступна под лицензией Apache 2.0:
🔗 https://wedlm.github.io
🔗 https://huggingface.co/tencent/WeDLM-8B-Instruct
Post #2179
5.59K

- ❤ 8
- 👍 7
- 🥰 1