👋 Alibaba Cloud представила новую флагманскую модель Qwen3-235B-A22B-Instruct-2507. Как и предыдущие LLM серии Qwen 3, она сочетает сильные показатели по всем классическим бенчмаркам и лицензируется под Apache 2.0.
🔹 Производительность и сравнение с закрытыми LLM
Модель показала впечатляющие результаты в задачах общего понимания и кодогенерации, обойдя по ряду метрик закрытые LLM. Не только GPT-4o, которую обошли уже многие, но и Anthropic Claude 4 Opus (версию без reasoning).
⬇️
На бенчмарках типа GPQA, SimpleQA и задачах по программированию (LiveCodeBench, Arena-Hard, BFCL-v3 и др.) она часто набирает наивысшие или близкие к ним оценки, что говорит о смене тенденции:
📈 качество открытых моделей не уступает, а в ряде случаев обгоняет проприетарные аналоги.
🔹 Архитектура и технические характеристики
Qwen3-235B-A22B-Instruct-2507 — это модель Mixture-of-Experts (MoE) архитектуры.
Содержит 235 млрд параметров (из них 22 млрд активны на токен), 94 слоя, 64 «запросных» и 4 «ключ/значение» attention heads, а также 128 экспертных веток (с 8 активными одновременно).
Максимальный размер контекста — 262 144 токена. Такая конструкция позволяет эффективно распределять вычисления по экспертам.
🔹 Особенности применения
Модель не использует рассуждения. Хотя для точных задач, требующих глубоких логических цепочек, LRM предпочтительнее, инференс Instruct-модели быстрее, что делает её оптимальным инструментом для real-time чат-ботов и вызова функций.
Пост подготовил наш амбассадор Ruslan Dev — практик и исследователь в области современных AI/ML-технологий.
☁️ Рекомендованные начальные конфигурации для запуска Qwen3-235B-A22B-Instruct-2507 в точности 4 бита:
— teslaa100-2.24.256.240
— teslah100-2.24.256.240
🚀 Подключайтесь, тестируйте и разворачивайте собственные проекты в облаке immers.cloud!
