چگونه RAG کار میکند:
تولید تقویتشده با بازیابی یا RAG به مدل زبان اجازه میدهد تا پاسخها را بر اساس دانش خارجی ارائه دهد، نه فقط آنچه که روی آن آموزش دیده است:
1️⃣ کاربر یک سؤال میپرسد.
ممکن است ورودی فاقد زمینه کافی باشد، مثلاً: «آیا امکان خروجی PDF دارد؟»
2️⃣ مدل زبان بزرگ (LLM) سؤال را بازنویسی میکند.
با استفاده از تاریخچه گفتگو، سؤال را به یک پرسش مستقل تبدیل میکند:
«ویژگیهای پلن Pro چیست؟ آیا میتواند PDF صادر کند؟»
3️⃣ جستجوی معنایی فعال میشود.
پرسش مستقل به صورت برداری تبدیل شده و با بخشهای موجود در اسناد از طریق شباهت برداری مقایسه میشود.
4️⃣ پرامپت (ورودی مدل) ساخته میشود.
سیستم مرتبطترین بخشها را جمعآوری و آنها را در قالب پرامپتی ساختارمند قرار میدهد. این مرحله توسط یک زنجیره پرسش و پاسخ (QA Chain) انجام میشود که ترکیب میکند:
▪️ پرسش مستقل
▪️ زمینه بازیابی شده
▪️ قالب پاسخ
5️⃣ مدل زبان بزرگ پرامپت کامل را با دانش خارجی استدلال کند، حتی اگر روی آن آموزش ندیده باشد.
6️⃣ پاسخ نهایی تولید میشود.
پاسخ بر اساس اسناد بازیابی شده است، نه فقط حافظه داخلی مدل.
Post #1295
3.68K

- 👍 6
- ❤ 2