Alibaba официально представила Qwen 3.6-Plus, новую флагманскую языковую модель, наследницу серии Qwen 3.5.
В 3.6 Plus сделан акцент на агентный кодинг. Модель самостоятельно декомпозирует сложные задачи на уровне репозитория, пишет и тестирует код, итеративно отлаживает его до готового результата.
Контекстное окно в миллион токенов - это примерно 2000 страниц текста в одном запросе, что позволяет загружать целые кодовые базы и длинные документы целиком.
Максимальный выход - 65 536 токенов, СoT включен постоянно, есть поддержка function calling.
🟡 Тесты
🟢На Terminal-Bench 2.0 Qwen 3.6-Plus набирает 61,6 балла против 59,3 у Claude 4.5 Opus.
🟠На SWE-bench Verified: 78,8 против 80,9 у Claude.
🟢По обработке документов модель лидирует с показателем 91,2 на OmniDocBench v1.5.
Принципиальное отличие от предшественника: устранена проблема overthinking, которая была главной претензией разработчиков к Qwen 3.5. Модель тратит меньше токенов на рассуждения и ведет себя стабильнее в продакшн-сценариях.
По неофициальным тестам сообщества, скорость генерации примерно втрое выше, чем у Claude Opus 4.6, хотя time-to-first-token на бесплатном тарифе в среднем составляет 11,5 секунды.
Цена на платформе Alibaba Model Studio - от $0,5 до 2 за миллион входных токенов и от $3 до 6 за то же количество выходных.
Бесплатно - на OpenRouter (в режиме превью) и в веб-чате Qwen.
Планов на опен-сорс относительно нового флагмана Alibaba не озвучивала, но циркулируют слухи, что часть моделей серии Qwen 3.6 все-таки выложат в открытый доступ.
@ai_machinelearning_big_data
#news #ai #ml

