🐳 DeepSeek открыла веса DeepSeek-V4-Flash-Vision-Exp - первой экспериментальной мультимодальной модели семейства V4.
Модель построена на базе DeepSeek-V4-Flash и получила полноценное визуальное понимание: умеет работать с изображениями, скриншотами, графиками и использовать их в агентных сценариях.
По бенчмаркам DeepSeek:
- 36,5 на ApexBench против 26,2 у V4-Flash
- 27,3 на Agents' Last Exam
- 64,3 на Chartography
- 35,0 Pass@5 на ZeroBench
- в DeepSWE модель набрала 59,3, немного обойдя Opus-4.8 с 58,0
При этом текстовые агентные возможности остались примерно на уровне обычной V4-Flash.
Размер модели - около 305B параметров, лицензия MIT. В репозитории есть reference inference для vision encoder, MoE, DFlash attention и других компонентов.
https://huggingface.co/deepseek-ai/DeepSeek-V4-Flash-Vision-Exp
Post #5694
4.05K

- ❤ 10
- 👍 3
- 🥰 2