LLM на 3,66 млрд параметров приблизилась к Qwen3-8B в формальной логике 🤏
webAI выпустила TwIL-LM3-Pro, компактную модель на базе IBM Granite 4.2 3B.
По тестам разработчиков:
• результат сопоставим с Qwen3-8B по сводной метрике формальной логики;
• модель опережает публичную VibeThinker-3B во всех шести проверенных направлениях;
• 95,4% на логической подвыборке BIG-Bench Hard;
• 95% на математических задачах SVAMP.
Версия Q4_K_M занимает 2,09 GiB и, по карточке модели, запускается на CPU или видеокарте с 4 ГБ VRAM. При локальном использовании запросы обрабатываются на вашем устройстве, без оплаты облачного API.
За результатами стоит многоэтапное дообучение: логические задачи, разные траектории рассуждений, объединение весов и обучение с подкреплением.
Есть нюансы: опубликованные оценки получены на BF16, качество Q4 отдельно не измерено. Лицензия некоммерческая.
Хороший повод проверить, какая доля ваших запросов действительно требует самой мощной модели.
https://huggingface.co/webAI-Official/TwIL-LM3-Pro
Post #5667
4.68K

- 👍 34
- 🔥 17
- ❤ 6
- 😁 6
- ⚡ 2