این مقاله نشون میده که عملکرد مدلهای زبانی بزرگ، در مکالمات چند مرحلهای به طور قابل توجهی کاهش پیدا میکنه. بیشتر معیارهای ارزیابی بر روی تنظیمات دستورالعملهای کاملا مشخص و تک مرحلهای تمرکز دارن.
این تحقیق نشون میده که LLM ها اغلب در مراحل اولیه، فرضیات نادرستی میسازن و در ادامهی گفتگو به همان فرضیات تکیه میکنن و هرگز اونها رو اصلاح نمیکنن.
نتیجه اینه که اگه یه مکالمه ی چند مرحلهای به نتایج مطلوب نرسید، بهتره که گفتگو رو از نو و به صورت یک گفتگوی تازه آغاز کنیم و تمام اطلاعات مربوط به مکالمهی قبلی را در همان نوبت اول گفتگو جدید بگنجونید. همونطور که در شکل بالا میبینید این مساله مخصوصا در کاربرد هایی مثل مشاوره، برنامهنویسی، یا پرسشهای تحلیلی پیچیده اهمیت زیادی داره
https://arxiv.org/abs/2505.06120
Post #4039
4.06K

- 👍 41
- ❤ 2