И еще один генератор картинок! Теперь спецом под дизайн, постеры, юи и вот это вот все
Ant Group тихо бахнул Ming-Image-0.1-Design - 6B open-weight(!!) модель для картинок, которая особенно заточена под UI, постеры, инфографику, текст и дизайн.
Ништяки: до 2K, нативный RGBA с прозрачностью, всего 12 sampling steps.
И, внимание, расслоятор!
Отдельная модель Ming-Image-0.1-Design-Layer умеет брать готовую (вашу) картинку и разбирать её на отдельные RGBA-слои.
На дизайн арена Минг уже побивает Идеограм 4.
Где пробовать:
Hugging Face Space - самый простой вариант, прямо в браузере:
https://huggingface.co/spaces/hugging-apps/ming-image-0-1-design-demo
OpenRouter - уже появился API через NovitaAI. На момент проверки цена стоит $0. Да, пока бесплатно. Медианная генерация около 37 секунд:
https://openrouter.ai/inclusionai/ming-image-0.1-design
Локально тоже можно. Веса открыты под MIT:
https://github.com/inclusionAI/Ming-Image
https://huggingface.co/inclusionAI/Ming-Image-0.1-Design
Но: полный checkpoint около 53 GB, а официально проверенная конфигурация - CUDA GPU с 80 GB VRAM в BF16. Это не обязательно реальный минимум, просто пока именно такую конфигурацию валидировали разработчики.
ComfyUI тоже уже на подходе. Kijai написал поддержку, PR в основной ComfyUI открыт, но пока ещё не смёржен:
https://github.com/Comfy-Org/ComfyUI/pull/16482
Орудует тут:
https://huggingface.co/Kijai/Ming-Image-ComfyUI
И отдельно лежит Design-Layer:
https://huggingface.co/inclusionAI/Ming-Image-0.1-Design-Layer
Заинтригован, однако. Картинки на гитхабе прям сладкие.
@cgevent
Post #16751
4.22K