Это разреженная MoE: 35 млрд параметров , активны только 3 млрд.
Она превосходит плотную модель Qwen3.5-27B (27 млрд параметров) на ряде ключевых кодинговых бенчмарков и значительно опережает своего прямого предшественника Qwen3.5-35B-A3B, особенно в задачах агентного кодинга и рассуждения.
Qwen3.6 изначально мультимодальная, и Qwen3.6-35B-A3B демонстрирует возможности восприятия и мультимодального рассуждения, значительно превышающие ожидания от её размера, при всего ~3 млрд активных параметров.
На большинстве vision-language бенчмарков её результаты сопоставимы с Claude Sonnet 4.5 и даже превосходят его на ряде задач. Особенно заметны сильные стороны в пространственном интеллекте: 92.0 на RefCOCO и 50.8 на ODInW13.
Unsloth добавили GGUF, так что модель можно запускать локально на 23 ГБ ОЗУ / Mac в 4-битном режиме. (гайд) 😊
