Эту модель долго ждали и многого от неё ожидали - и, судя по первым впечатлениям, она оправдывает надежды.
Есть, конечно, и критика. Во-первых, у модели по умолчанию установлен
reasoning_effort=xhigh, и для многих задач это выглядит довольно странно: при таком режиме Qwen способна тратить огромное количество токенов на рассуждения, вплоть до того, что очень быстро забивает доступное контекстное окно даже на относительно простых задачах. Во-вторых, это заметно увеличивает время ответа — да и сама модель пока не отличается особой скоростью. Впрочем, сообщество уже активно ищет способы решить обе проблемы: экспериментирует с настройками reasoning, различными вариантами запуска и оптимизациями вроде Multi-Token Prediction (MTP) для ускорения инференса.https://simonwillison.net/2026/Aug/16/qwen-38-27b/
@g33ks