🔥 Qwen3.8-Flash выглядит очень сильно
* 125B MoE-параметров, но активны только 6B
* SWE-bench Pro: 62.5 против 53.4 у Opus 4.6 Max
* ранний превью архитектуры Qwen4
* обучение обошлось примерно в 9 раз дешевле, чем у Qwen3.7-Plus
Получается очень агрессивное сочетание цены, скорости и качества, особенно для coding-задач.
- Blog: https://qwen.ai/blog?id=qwen3.8-flash-next
- Technical Report: https://github.com/QwenLM/Qwen3.8-Flash-Next/blob/main/tech_report.pdf
- Hugging Face: https://huggingface.co/Qwen/Qwen3.8-Flash-Next?spm=a2ty_o06.30285417.0.0.1d73c921FsyOPe&file=Qwen3.8-Flash-Next
- ModelScope: https://modelscope.cn/models/Qwen/Qwen3.8-Flash-Next?spm=a2ty_o06.30285417.0.0.1d73c921XAP2dV&file=Qwen3.8-Flash-Next
Post #5661
4.98K

- 🔥 23
- 👍 12
- ❤ 7
- 🥴 1