TGViewer
MathSBU MathSBU @mathsbu · 2.63K subscribers
Post #3370 1.28K

Forwarded from Xerac.ir

کاهش هزینه مدل‌های OpenAI با قابلیت Prompt Caching

شاید متوجه شده باشید که وقتی توی یک مکالمه کلی پیام رد و بدل کردید، هزینه تولید پیام جدید بیشتر میشه. علتش اینه که مدل برای ایجاد هر پاسخ جدید، همه پیام‌های قبلی رو یک دور از اول مرور می‌کنه تا اگر سوالتون به پیام‌های قبلی اشاره‌ای کرده باشه، بتونه به‌درستی اون رو تشخیص بده و پاسخ بده. برای همین تعداد توکن‌های مصرفی و هزینه ایجاد پیام جدید به تدریج بیشتر میشه.
اینجاست که پرامپت کشینگ به کار میاد. با این قابلیت، وقتی توی یک مکالمه طولانی (حدود ۵۰۰ کلمه به بالا) پیام جدید بدید، مدل به مدت ۵ دقیقه کل مکالمه قبلی رو حفظ می‌کنه...این یعنی اینکه اگر مکالمه شما ادامه پیدا کنه و در هر 5 دقیقه حداقل یک پیام بدهید، هزینه مکالمه شما تا 50 درصد کاهش پیدا میکنه.

برای استفاده از این قابلیت نیاز به هیچ کاری نیست و از امروز برای مدل‌های OpenAI مثل GPT-4o-mini ،GPT-4 و GPT 4o در زیرک فعال شده!

Xerac.ir
  • 👍 1
More from @mathsbu
  1. Oct 6, 2026سوالهای روز دوم آزمون انتخابی تیم ریاضی دانشکده
  2. Oct 6, 2026photo post
  3. Oct 6, 2026🆗 فراخوان ثبت‌نام مسابقات فوتسال درون‌دانشکده‌ای 🚨 به اطلاع دانشجویان دانشکده ریاضی می‌ر…
  4. Oct 5, 2026آزمون با تاخیر کلاس ۲۱۰ در حال برگزاریست.
  5. Oct 3, 2026🟢 قابل توجه دانشجویان کارشناسی که درس ریاضی عمومی 2 (2201094 گروه1) را این ترم اخذ کرده ا…
  6. Oct 3, 2026🟢قابل توجه دانشجویان کارشناسی علوم کامپیوتر که درس معادلات دیفرانسیل گروه 95 را اخذ کرده…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →