TGViewer
Linuxor ? Linuxor ? @linuxor · 32.3K subscribers
Post #4555 9.71K
یه توضیحی راجع به صحبت شخص کدلوژیست من اضافه کنم

حرف کدلوژیست درسته و این روش واقعا توی وایب کدینگ استفاده می‌شه اما زیاد آنچنان خیلی خفن بهتون کمک نمیکنه چون قضیه برمیگرده به اوایل هوش مصنوعی که این ایده ایجاد شد ولی بعدش دیدن زیاد آنچنان مدل رو باهوش و خفن نمی‌کنه چون خطر بهینه‌سازی روی معیار اشتباه (Goodhart's Law) وجود داره
بزرگ‌ترین مشکل اینه که مدل ممکنه یاد بگیره چیزی رو بهتر کنه که اندازه‌گیری می‌شه، نه چیزی که واقعاً مهمه.
مثلاً:
معیار ارزیابی: تست‌ها پاس بشن
نتیجه: مدل کدی می‌نویسه که تست‌ها رو دور می‌زنه ولی معماری بدی داره.
یا مثلا
معیار: کاربر سریع جواب بگیره
نتیجه: مدل پاسخ‌های کوتاه و سطحی تولید می‌کنه.

یعنی حلقه‌ی ارزیابی ممکنه مدل رو به سمت بازی کردن با معیار سوق بده به قولی اگه مدلی خوب نباشه خودتونم بکشید نمی‌تونید بهترش کنید. ولی تجربیات میگن این نوع حلقه کمک می‌کنه درکل ولی اونقدر که فکر می‌کنید کمکش زیاد نیست.

@Linuxor
More from @linuxor
  1. Oct 10, 2026خیلی جالبه یک ماه از ادعای اثبات یکی از هفت مسئله بزرگ تاریخ ریاضیات توسط OpenAI داره می‌گ…
  2. Oct 10, 2026مایکروسافت از Microsoft-Decision-1 رونمایی کرد؛ مدلی که به‌جای تولید متن‌های طولانی، برای…
  3. Oct 10, 2026یکی از بچه های کانال که نابینا هستش و با ابزار های جانبی داره از تلگرام استفاده می‌کنه یه…
  4. Oct 10, 2026مایکروسافت به‌تازگی یه پروژه سیستم‌عامل مبتنی بر زبان برنامه‌نویسی Rust منتشر کرده که برای…
  5. Oct 9, 2026هندیا ریدن به ایلان ماسک موکش آمبانی مالک اپراتور هندی Jio همونی که اشتراکای جمنای پرو به…
  6. Oct 9, 2026نسخه دسکتاپ Atomic Agent برای ویندوز و مک و لینوکس منتشر شد برنامه Atomic Agent تمرکزش روی…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →