TGViewer
مسعود بیگی مسعود بیگی @tondtech · 2.88K subscribers
Post #4409 903

Forwarded from Reza Jafari

این Harness که میگن یعنی چه؟

اگه بخوایم خیلی ساده بگیم، Harness چیزیه که دورِ مدل هوش مصنوعی قرار می‌گیره و کمک می‌کنه مدل فقط جواب نده، بلکه بتونه واقعاً کاری رو انجام بده. خود مدل رو می‌شه مثل «مغز» در نظر گرفت؛ مغزی که فکر می‌کنه و تصمیم می‌گیره قدم بعدی چی باشه. Harness هم چیزهاییه که این مغز برای کار کردن لازم داره؛ مثل ابزارها، حافظه، محیط اجرا، فایل‌ها و قوانین امنیتی. در واقع می‌شه گفت: Agent = Model + Harness.

برای اینکه بهتر متوجه بشیم، فرض کن یه Agent قراره یه باگ رو توی کد پیدا و برطرف کنه. مدل اول کد و اطلاعات موجود رو بررسی می‌کنه و تصمیم می‌گیره چه کاری انجام بده. بعد Harness اون کار رو اجرا می‌کنه؛ مثلاً کد رو داخل یه محیط ایزوله اجرا می‌کنه و تست‌ها رو انجام می‌ده. نتیجه تست دوباره به مدل برمی‌گرده و مدل با توجه به نتیجه تصمیم می‌گیره قدم بعدی چیه. این چرخه یعنی «فکر کن، عمل کن، نتیجه رو ببین و دوباره تصمیم بگیر» پایه خیلی از Agentهای امروزیه.

نکته مهم اینه که مدل، Agent و Harness یکی نیستن. مدل همون بخشیه که فکر می‌کنه و خروجی تولید می‌کنه؛ Harness محیط و زیرساختیه که ابزارها، حافظه، اجرا و قوانین رو مدیریت می‌کنه؛ و Agent در نهایت ترکیب این دوتاست که می‌تونه یک کار واقعی رو از اول تا آخر انجام بده. بنابراین وقتی می‌گیم یک Agent باهوشه، فقط قدرت مدل مهم نیست؛ محیطی که اون مدل داخلش کار می‌کنه هم تأثیر خیلی زیادی روی نتیجه داره.

داخل یک Harness خوب، چند چیز خیلی مهم وجود داره: ابزارهایی برای کار با API، دیتابیس، وب یا اجرای کد؛ حافظه‌ای برای نگه داشتن اطلاعات قبلی؛ یک محیط امن مثل Sandbox برای اینکه Agent بتونه بدون آسیب زدن به سیستم اصلی کد اجرا کنه؛ و سیستم‌هایی برای مدیریت فایل و اطلاعات. علاوه بر این‌ها، Harness باید بتونه عملکرد Agent رو بررسی کنه و اگر لازم بود از انسان برای بعضی تصمیم‌های حساس تأیید بگیره.

یکی از مهم‌ترین بخش‌ها هم مدیریت حافظه و Context هست. مدل‌های هوش مصنوعی به‌تنهایی حافظه دائمی ندارن و نمی‌تونن بی‌نهایت اطلاعات رو همزمان در ذهنشون نگه دارن. Harness کمک می‌کنه اطلاعات مهم حفظ بشه، بخش‌های قدیمی‌تر خلاصه یا حذف بشن و در صورت نیاز اطلاعات قبلی دوباره در اختیار مدل قرار بگیره. این موضوع مخصوصاً برای کارهای طولانی و چندمرحله‌ای خیلی مهمه.

از طرف دیگه، یه Agent خوب نباید فقط کاری رو انجام بده و بگه «تموم شد». باید بتونه نتیجه کار خودش رو هم بررسی کنه. مثلاً اگر قرار بوده کدی رو اصلاح کنه، تست‌ها رو اجرا کنه و ببینه واقعاً مشکل حل شده یا نه. اگر تست شکست خورد، Agent باید نتیجه رو ببینه، دوباره فکر کنه و مسیرش رو اصلاح کنه. همین حلقه‌های بررسی و اصلاح باعث می‌شن Agentها برای کارهای پیچیده قابل‌اعتمادتر بشن.

موضوع امنیت هم خیلی جدیه. فرض کن Agent اجازه داشته باشه فایل پاک کنه، ایمیل بفرسته یا خرید انجام بده. منطقی نیست هر کاری رو بدون محدودیت انجام بده. برای همین Harness می‌تونه قوانینی داشته باشه که مثلاً قبل از انجام یک کار حساس، حتماً از یک انسان تأیید بگیره. به این کنترل‌ها اصطلاحاً Guardrail گفته می‌شه و کمک می‌کنن Agent از محدوده‌ای که براش تعیین شده خارج نشه.

در نهایت، چیزی که شاید از همه مهم‌تر باشه اینه که کیفیت یک Agent فقط به مدل هوش مصنوعی بستگی نداره. ممکنه دو سیستم دقیقاً از یک مدل استفاده کنن، ولی یکی نتیجه خیلی بهتری بگیره؛ چون حافظه، ابزارها، نحوه اجرای کار، بررسی نتیجه و قوانین کنترلی بهتری داره. به همین خاطر هرچه مدل‌ها قوی‌تر می‌شن، طراحی درست Harness هم اهمیت بیشتری پیدا می‌کنه. به زبان خیلی ساده، مدل هوش سیستم رو می‌ده، ولی Harness کمک می‌کنه این هوش تبدیل به کار واقعی و قابل‌اعتماد بشه.

👑 توضیحات در مورد دوره منتورینگ
🏆 نحوه ثبت‌نام در دوره منتورینگ
🤝 تجارب موفق قبلی بچه‌ها از منتورینگ

@reza_jafari_ai
  • 👍 5
More from @tondtech
  1. Oct 5, 2026📢 جذب برنامه‌نویس Backend .NET | Mid-Level ما برای تکمیل تیم فنی خود به دنبال یک برنامه‌ن…
  2. Oct 4, 2026بین بی حوصلگی های این روزها، https://chida.shop/ برای خودش داره رشد میکنه، دیزاینش تقریبا…
  3. Oct 4, 2026🚀 استخدام Backend Developer (Django) برای پیوستن به یک تیم فنی و با Ownership بالا به دنب…
  4. Oct 4, 2026قسمت اول از طراحی سیستم ورک فلو انجین - چیزی شبیه به n8n توی این جلسه سعی میکنیم، یه ورک ف…
  5. Oct 3, 2026[Intro] [Instrumental: short lyrical violin opening, warm orchestral strings; tombak, tamb…
  6. Oct 3, 2026بله، حداقل آسترا تونست تا حد خوبی جلو بره و مرزهای تصورم از توانایی های نزدیک کردن محاسبات…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →