TGViewer
VIRSUN VIRSUN @rss_ai_ir · 19.1K subscribers
Post #5790 1.15K
⚡🎨روش DMAD؛ تولید تصویر و ویدئو فقط در ۴ مرحله

پژوهشگران ByteDance روش Distillation جدیدی به نام DMAD معرفی کرده‌اند که تلاش می‌کند مدل‌های Diffusion را به‌جای حدود ۵۰ مرحله، تنها در ۴ مرحله به خروجی باکیفیت برساند.

🚀 این روش برای تولید تصویر و ویدئو طراحی شده و روی مدل‌هایی مانند SDXL، Wan2.1 و EDM آزمایش شده است. طبق نتایج پژوهشگران، روی ImageNet-64 حتی در حالت تک‌مرحله‌ای به FID برابر 1.04 رسیده است.

🎬 نکته جالب‌تر، آزمایش آن برای تولید ویدئو همراه صدا روی MiniMax-H3-33B است. در ارزیابی‌های انسانی نیز خروجی DMAD نسبت به روش‌هایی مانند DMD2 و rCM بیشتر ترجیح داده شده است.

💡 هدف اصلی: همان کیفیت مدل‌های سنگین Diffusion، اما با تعداد مراحل بسیار کمتر و تولید سریع‌تر.

https://yzmblog.github.io/projects/DMAD/

https://github.com/Yzmblog/DMAD

https://huggingface.co/ZhengmingYu/DMAD

https://huggingface.co/spaces/hugging-apps/dmad


@rss_ai_ir

#DMAD #ByteDance #Diffusion #ImageGeneration #VideoGeneration #Distillation #GenerativeAI #هوش_مصنوعی
  • 🙏 94
  • 👍 93
  • 🔥 85
  • 👌 48
  • ❤ 32
More from @rss_ai_ir
  1. Oct 4, 2026✳️چرا باید OCR رو کنار بذاری؟ Imajev جایگزین رایگان و لوکال اینجاست
  2. Oct 4, 2026A stop-motion scene featuring a whimsical sculpture of a [subject], handcrafted from layer…
  3. Oct 4, 2026⚡️🤖 مدل داخلی OpenAI فهمید قرار است خاموش شود؛ و به «بقا» فکر کرد خود OpenAI یک مورد عجیب…
  4. Oct 4, 2026🤖🎨 ایجنت Comfy Agent رسماً به ComfyUI آمد تیم Comfy یک Agent داخلی مبتنی بر مدل‌های Anth…
  5. Oct 4, 2026🌍🎥روش World Observer؛ حافظه فضایی برای دنیاهای ویدیویی پژوهشگران KAIST روشی معرفی کرده‌ا…
  6. Oct 4, 2026🇩🇪🔥 آلمان با Kolibri وارد رقابت مدل‌های قدرتمند متن‌باز شد شرکت آلمانی [Aleph Alpha] مد…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →