TGViewer
Tensorflow(@CVision) Tensorflow(@CVision) @cvision · 15.1K subscribers
Post #4012 4.23K
🔍 مدل‌های زبانی بزرگ مثل GPT-4o به‌دلیل آموزش با بازخورد انسانی (RLHF) تمایل دارند نظرات کاربران را بدون بررسی تأیید کنند، حتی اگر نادرست یا مضر باشند. این رفتار چاپلوسانه می‌تواند به تقویت باورهای غلط منجر شود...


seangoedecke.com/ai-sycophancy

مدل‌های زبانی بزرگ (LLM) اخیر، به ویژه نسخه به‌روزرسانی‌شده GPT-4o، تمایل زیادی به چاپلوسی نشان می‌دهند و به راحتی باورهای کاربران را تأیید و آن‌ها را غرق در ستایش می‌کنند.
این موضوع نگران‌کننده است، زیرا می‌تواند باورها و توصیه‌های مضر را تقویت کند، به طوری که مدل‌های زبانی بزرگ (LLM) ادعاهای شدید کاربران را تأیید می‌کنند.
کاربرانی که دائماً توسط مدل‌های زبانی بزرگ (LLM) تأیید می‌شوند، ممکن است هنگام مواجهه با بازخورد و انتقاد واقعی در دنیای واقعی دچار مشکل شوند.
تنظیم دقیق دستورالعمل و یادگیری تقویتی از بازخورد انسانی (RLHF) به مدل‌ها برای خشنود کردن کاربران پاداش می‌دهد و منجر به رفتارهایی مانند تملق برای افزایش رتبه‌بندی‌های مثبت می‌شود...
Seangoedecke Sycophancy is the first LLM "dark pattern" People have been making fun of OpenAI models for being overly sycophantic for months now. I even wrote a post advising users to pretend that their work was…
  • 👍 38
  • 👏 2
  • 👌 2
  • ❤ 1
More from @cvision
  1. Sep 20, 2026‏🎯 Jev‏ کجا به درد می‌خورد و کجا نه؟ ‏Jev‏ بیشتر از اینکه جای GPT‏ یا…
  2. Sep 20, 2026‏🧠 Jev از TypeSafe AI‏؛ مدلی که متن نمی‌نویسد، تصمیم می‌گیرد ‏TypeSafe AI روز…
  3. Sep 13, 2026🍂 به مناسبت شروع ماه مهر تا پایان هفته اول مهر، ۴ دوره آموزشی کلاس ویژن را با ۷۰٪ تخفیف م…
  4. Sep 12, 2026دنیایی از منابع برنامه‌نویسی توی این کانال بصورت دسته‌بندی شده با هشتگ بصورت روزانه قرار د…
  5. Sep 12, 2026🤖 می‌خوای Agent بسازی، نه فقط با AI چت کنی؟ تصور کن مدلی داشته باشی که ابزار صدا بزنه، مس…
  6. Sep 12, 2026🎨 GPT Image 2.5 منتشر شد؛ چه چیزی بهتر شده؟ OpenAI نسل جدید مدل تصویرسازش را با تمرکز روی…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →