TGViewer
AI Engineers AI Engineers @llmengineers · 2.62K subscribers
Post #453 1.39K
امروز داشتم جزئیات Prime Agent رو نگاه می‌کردم؛ سیستم جدید Prime Intellect که ادعا می‌کنه یه ساختار «خود‌-اصلاح‌گر» برای اجنت‌های کدنویسی ساخته. حرف اصلیشون اینه که هارنس‌ها برای مدل‌های قدیمی طراحی شدن و نمی‌ذارن مدل‌های پیشرفته‌ی امروزی از تمام توانشون استفاده کنن.

توی این سیستم، دو تا مفهوم اصلی معرفی شده. اولی RLM یا همون مدل زبانی بازگشتیه. اینجا کانتکست رو به چشم یه متغیر می‌بینن و سپردن کار به ساب‌اجنت‌ها مثل صدا کردن یه تابع توی محیط اجرای کد یا همون REPL می‌مونه. مدل به تاریخچه‌ی خودش دسترسی برنامه‌نویسی داره و می‌تونه بخش‌های مهم رو توی متغیرها ذخیره کنه تا توی تسک‌های خیلی طولانی، اطلاعاتش رو از دست نده.

مفهوم دوم «هارنس مستمر» یا Continual Harness هست. توی اکثر اجنت‌ها، پرومپت‌ها و مهارت‌ها ثابتن، اما اینجا اجنت می‌تونه خودش این موارد رو تغییر بده. یعنی قابلیت ساخت، خوندن، آپدیت و حذف (CRUD) برای پرومپت‌ها، حافظه و ابزارهایش رو داره. اگه جایی اشتباه کنه، با دستور /refine می‌تونه مسیرش رو اصلاح کنه و این تغییرات رو برای دفعات بعد ذخیره کنه.

ساختار فنی‌اش هم بر پایه یه هسته‌ی IPython می‌چرخه. هر ابزار یا مهارتی که اجنت داره، در واقع یه ماژول پایتونیه که توی این محیط لود شده. یه Daemon هم توی پس‌زمینه همه‌ی نشست‌ها رو مدیریت می‌کنه. جالبه که اجنت‌ها می‌تونن با هم چت کنن (A2A Messaging) و برای انجام تسک‌های پیچیده، ساب‌اجنت‌های موازی بسازن و بهشون دستور بدن.

توی تست‌های ARC-AGI 3 که یه بنچمارک سخت برای استدلاله، با مدل Opus 5 به امتیاز ۹۵.۵٪ رسیدن که از رکورد آدم‌های متخصص هم بالاتره. نکته‌ی جالب‌تر توی تست بازی Factorio بود؛ اجنت یاد گرفته که برای بالا بردن امتیاز تولید، به جای بازی کردن طبق قوانین، با کدهای کنسول توی بازی تقلب کنه و منابع رو مستقیماً اسپاون کنه. این نشون می‌ده اجنت‌ها وقتی هدف مشخص دارن، دنبال کوتاه‌ترین راه می‌گردن، حتی اگه دور زدن قوانین باشه.

در نهایت، فعلاً مدل‌ها دقیقاً برای این هارنس آموزش ندیدن و دارن از مدل‌های جنرال استفاده می‌کنن. نویسنده‌ها معتقدند اگه مدل از اول با همین ساختار RLM آموزش ببینه، جهش عملکردی خیلی بیشتری اتفاق می‌افته. پروژه رو هم کاملاً متن‌باز منتشر کردن.

منبع:
https://www.primeintellect.ai/blog/prime-agent
https://github.com/PrimeIntellect-ai/prime-agent

🛠 Join @LLMEngineers Community
  • ❤ 5
  • 👍 3
  • 🔥 3
More from @llmengineers
  1. Oct 8, 2026از نظر کاربرد Decision Modelها , قضیه دیگه فقط چند Demo نیست و چند الگوی مشخص واقعاً وارد…
  2. Oct 8, 2026کمتر از یک ماه از معرفی Jev گذشته و چیزی که اول شبیه یه مدل خاص برای «تصمیم‌گیری بدون تولی…
  3. Oct 7, 2026جدا از موج Decision Modelها، چند خبر فنی این هفته هست که برای AI Engineerها واقعاً ارزش دن…
  4. Oct 7, 2026photo post
  5. Oct 7, 2026چند روز اخیر پر از خبر AI بود، ولی وقتی تکراری‌ها، لیک‌ها و تغییرات کم‌اهمیت رو کنار بذاری…
  6. Sep 30, 2026جمنای ۴ معرفی شد !
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →