TGViewer
آقای هوش مصنوعی آقای هوش مصنوعی @mrartificialintelligence · 20.7K subscribers
Post #5320 360
🚀 هوش مصنوعی ۱۰ برابر حافظه کمتر مصرف می‌کند و تا ۷ برابر سریع‌تر می‌شود!

برخی مدل‌های زبانی برای افزایش توانایی خود، به‌جای استفاده از لایه‌های متعدد، چند لایه را بارها اجرا می‌کنند. به این معماری‌ها Looped Language Models گفته می‌شود.

اما یک مشکل وجود دارد:

هر بار تکرار می‌تواند حافظه بیشتری اشغال کند و همین موضوع باعث افزایش هزینه اجرای AI و کاهش تعداد کاربرانی می‌شود که می‌توانند هم‌زمان از آن استفاده کنند.

حالا پژوهشگران روشی به نام Hybrid Latent Attention معرفی کرده‌اند که برای حل این مشکل طراحی شده است.

🧠 چطور کار می‌کند؟

به‌جای اینکه مدل تمام اطلاعات قبلی را با جزئیات کامل در حافظه نگه دارد، اطلاعات قدیمی‌تر را فشرده می‌کند و فقط اطلاعات جدید را با جزئیات کامل حفظ می‌کند.

📊 نتایج بدست آمده :

🔹 ۱۰.۷ برابر کاهش مصرف حافظه به‌ازای هر توکن

🔹 امکان اجرای ۴ تا ۸.۸ برابر درخواست هم‌زمان بیشتر روی یک GPU

🔹 ۲.۵ برابر افزایش سرعت در متن‌های ۱۰۰۰ توکنی

🔹 تا ۷.۴ برابر افزایش سرعت در متن‌های ۱۶ هزار توکنی

📌 آقای هوش مصنوعی
🔗 @MrArtificialintelligence
  • ❤ 4
  • 👏 3
More from @mrartificialintelligence
  1. Oct 8, 2026📚 معرفی کتاب | عملیاتی‌سازی استانداردها وقتی استانداردها به زیرساخت تحول دیجیتال و هوش مص…
  2. Oct 7, 2026🎬 I, Robot؛ وقتی هوش مصنوعی برای «محافظت از انسان» آزادی او را می‌گیرد فیلم علمی‌تخیلی I,…
  3. Oct 7, 2026🩺 آیا دستگاه MRI تمام‌بدن می‌تواند روزی در کف دست پزشک جا بگیرد؟ پروفسور میچیو کاکو در نش…
  4. Oct 7, 2026⚡️ آیا هوش مصنوعی به زیرساختی ضروری مثل برق تبدیل خواهد شد؟ پنگ شیائو، مدیرعامل گروه G42،…
  5. Oct 7, 2026🤖 وقتی ربات‌ها غذا توزیع می‌کنند و انسان‌ها فقط در صف منتظرند… این تصویر دیستوپیایی، آیند…
  6. Oct 7, 2026🧠 نوبل پزشکی ۲۰۲۶؛ فناوری‌ای که اجازه می‌دهد فعالیت سلول‌های مغز را با نور کنترل کنیم کار…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →