📌 Tencent выпустил новую open-source модель WeDLM-8B-Instruct :
WeDLM-8B-Instruct: модель на ~8 млрд параметров, настроенная для диалогов и выполнения команд. Работает быстрее многих авто-регрессионных моделей и хорошо подходит для практических задач.
🚀 Плюсы
- параллельная генерация — меньше задержек
- поддержка KV-кэша и современных оптимизаций
- в ряде задач быстрее аналогов (до 3–6× на бенчмарках)
📊 Производительность
Модель показывает уверенные результаты на бенчмарках по логике, коду и знаниям, опережая базовые версии в своём классе.
📌 Характеристики
- 8B параметров
- контекст до 32 768 токенов
- лицензия Apache-2.0
🔧 Как начать
Можно запускать через собственный движок WeDLM или через стандартный Transformers API.
👉 Подходит тем, кто хочет быстро и локально развернуть мощную LLM.
Ссылка: https://huggingface.co/tencent/WeDLM-8B-Instruct
Post #2575
4.33K


- 👍 9