کاربری تونسته با DiffusionGemma که مدلی برای تولید متن با معماری diffusion هستش، به یه مدل شبیه به Jev برسه.
ایده اینه که بهجای تولید توکنبهتوکن، DiffusionGemma گزینههای ساختاریافته رو روی یک canvas قرار میده و با diffusion همه گزینهها رو بهصورت موازی بررسی میکنه؛ یعنی با یک پاس میتونه برای تصمیمهایی مثل Yes/No و چندگزینهای، جواب و میزان اطمینان مدل رو استخراج کنه.
این معماری از attention دوطرفه کامل استفاده میکنه، بنابراین هر گزینه همزمان به کل context دسترسی داره و میتونه توزیع تصمیمگیری کالیبرهتری بده. از طرف دیگه، قابلیتهای multimodal و درک فضایی Gemma 4 رو هم به ارث میبره؛ اجرای یک پاس diffusion هم روی DGX Spark حدود 0.2 ثانیه گزارش شده.
جالبتر اینکه خود گوگل رسماً این رو با عنوان «DiffusionGemma as Jev» معرفی کرده و گفته این پروژه قدرت معماریهای non-autoregressive رو نشون میده.
@Linuxor
Post #5360
7.77K
