LM Studio выпустило поддержку MTP-моделей.
Я сразу пошел тестировать Qwen 3.6 27b, отдает 20 токенов в секунду, что совсем недурно.
Нужно понимать, что модель dense, а не MoE — поэтому такое количество токенов очень много для запуска на Macbook Pro M4 Max. Пользоваться можно прямо сейчас.
Post #715
423
