TGViewer
RoboEpics RoboEpics @roboepics · 451 subscribers
Post #153 437

Forwarded from Xerac.ir

کاهش هزینه مدل‌های OpenAI با قابلیت Prompt Caching

شاید متوجه شده باشید که وقتی توی یک مکالمه کلی پیام رد و بدل کردید، هزینه تولید پیام جدید بیشتر میشه. علتش اینه که مدل برای ایجاد هر پاسخ جدید، همه پیام‌های قبلی رو یک دور از اول مرور می‌کنه تا اگر سوالتون به پیام‌های قبلی اشاره‌ای کرده باشه، بتونه به‌درستی اون رو تشخیص بده و پاسخ بده. برای همین تعداد توکن‌های مصرفی و هزینه ایجاد پیام جدید به تدریج بیشتر میشه.
اینجاست که پرامپت کشینگ به کار میاد. با این قابلیت، وقتی توی یک مکالمه طولانی (حدود ۵۰۰ کلمه به بالا) پیام جدید بدید، مدل به مدت ۵ دقیقه کل مکالمه قبلی رو حفظ می‌کنه...این یعنی اینکه اگر مکالمه شما ادامه پیدا کنه و در هر 5 دقیقه حداقل یک پیام بدهید، هزینه مکالمه شما تا 50 درصد کاهش پیدا میکنه.

برای استفاده از این قابلیت نیاز به هیچ کاری نیست و از امروز برای مدل‌های OpenAI مثل GPT-4o-mini ،GPT-4 و GPT 4o در زیرک فعال شده!

Xerac.ir
  • ❤ 4
More from @roboepics
  1. Oct 30, 2024هدف اصلی ما در زیرک اینه که عموم مردم رو با فناوری‌های جدید هوش مصنوعی بیشتر آشنا کنیم. چر…
  2. Oct 30, 2024ما در زیرک علاوه بر تلاش برای ایجاد دسترسی عمومی و با کیفیت به فناوری‌های هوش مصنوعی، آزما…
  3. Oct 23, 2024لینک لوکیشن محل برگزاری رویداد پارک فناوری پردیس، آمفی تئاتر ساختمان فن بازار رویداد Level…
  4. Oct 23, 2024https://olympics.tech/content/?id=20
  5. Oct 11, 2024این ممکن است مهم‌ترین واقعیت درباره کل تاریخ تا به امروز باشد. احتمال دارد که در چند هزار…
  6. Oct 11, 2024عصر هوشمندی در چند دهه‌ی آینده، قادر خواهیم بود کارهایی انجام دهیم که برای پدربزرگ و مادرب…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →