TGViewer
بازه باز بازه باز @eots1 · 263 subscribers
Post #4241 16
بازه باز مثلا در کانتکست 1 میلیون توکن، مشکل اصلی فقط پردازش نیست، بلکه نگه‌داشتن تاریخچه چت ها در حافظه موقت یا همون KV Cache عه که معمولا صدها گیگ کارت گرافیک میخواد.
حالا این مدل اومده با حذف فول‌ اتنشن و ترکیب 39 لایه لوکال با 9 لایه اسپارس، و فعال‌سازی فقط 5 درصد وزن‌ها در هر کلمه ،
هزینه پردازش مثلا یه متن 1 میلیون توکنی رو از سطح یه غول چند صد میلیاردی به سطح یه مدل یک بیستم ارزون تر رسونده.

اینش جالبه که تونستن دیوار KV Cache رو دور بزنن
  • ❤ 1
  • 👍 1
More from @eots1
  1. Sep 28, 2026مثلا در کانتکست 1 میلیون توکن، مشکل اصلی فقط پردازش نیست، بلکه نگه‌داشتن تاریخچه چت ها در…
  2. Sep 28, 2026دوستان اگر نفهمیدین چرا میگم جالبه، در مدل‌های بزرگ فعلی، برای کانتکست‌های خیلی طولانی یا…
  3. Sep 28, 2026دنیای تکنولوژی جالبه اوایل میگفتن کلی دیتاسنتر و برق میخوایم برای هوش مصنوعی اما مدل‌ها رو…
  4. Sep 28, 2026خوشبین شدم تا یکی دوسال دیگه شاید بتونیم مغزی در حد کلاود اپوس، روی سیستم شخصیمون ران کنیم…
  5. Sep 28, 2026این چینی‌ها واقعا نابغن.
  6. Sep 28, 2026اینش هیچی معماریش خیلی جالبه با 308B پارامتر در حد یک مدل بزرگه. یک ترنسفورمر با معماری اس…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →