TGViewer
هوش مصنوعی و علم داده به فارسی هوش مصنوعی و علم داده به فارسی @dataplusscience · 6.06K subscribers
Post #3735 100
‏🧠 مدل‌های زبانی با قابلیت مدیریت مستقیم حافظه

‏محققان متا در مدل‌های جدیدی با عنوان Context Language Models (CLM)، منطق سنتی مدیریت حافظه را کنار گذاشته‌اند. در این روش، مدل به‌جای انباشت متوالی تاریخچه چت، امکان دسترسی و ویرایش مستقیم فایل متنِ حاوی «کانتکست» خود را از طریق دستورات Bash دارد.

‏مدل می‌تواند در هر لحظه بخش‌های قدیمی را پاک کند، خلاصه‌ای از نتایج بنویسد یا جزئیات مهم را بازنویسی کند. در آزمایش‌ها، مدل‌ها به‌طور خودکار شروع به ایجاد جداول وضعیت یا حذف نتایج جستجوی غیرضروری کردند تا حجم کانتکست خود را در محدوده ۶ تا ۸ هزار توکن نگه دارند.

‏مهم‌ترین نتایج این پژوهش:
‏* افزایش کارایی: مدل Qwen3.5-9B پس از آموزش با این روش، در بنچمارک BrowseComp-Plus رشد دقت قابل‌توجهی داشته و مصرف محاسباتی آن ۳۸.۸ درصد کاهش یافته است.
‏* بهینه‌سازی حافظه: با تکنیک Suffix Cache Reuse، بخش‌هایی از کانتکست که تغییر نکرده‌اند همچنان از KV-cache استفاده می‌کنند که منجر به کاهش ۳۵ درصدی محاسبات سرور می‌شود.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما
More from @dataplusscience
  1. Oct 2, 2026‏🛠 عرضه ابزار متن‌باز MCP برای سرویس ترب ‏ابزار جدیدی برای تعامل با سرویس «ترب» ب…
  2. Oct 2, 2026‏🤖 معرفی مدل‌های Intern-Decision برای تصمیم‌گیری ساختاریافته ‏خانواده مدل‌های Int…
  3. Oct 2, 2026‏🤖 شکستن کد ۲۱۷ ساله ناپلئون با GPT-6 Astra ‏کارتر چرچ با استفاده از مدل GPT-6 As…
  4. Oct 2, 2026‏📉 کاهش محدودیت‌های GPT-6 Pro و هدیه ۲۵۰۰ دلاری OpenAI به کاربران ‏شرکت OpenAI تغ…
  5. Oct 2, 2026‏🌐 شناسایی کمپین استخراج غیرمجاز از مدل‌های OpenAI ‏شرکت OpenAI در بررسی‌های اخیر…
  6. Oct 2, 2026‏انتشار مدل‌های ترجمه Index-Translate توسط Bilibili ‏تیم Index LLM در پلتفرم Bilib…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →