🚨 داری برای Claude و Codex پول OCR میدی، بدون اینکه بفهمی!
وقتی یک PDF شلوغ یا اسکنشده را مستقیم وارد مدل میکنی، بخش زیادی از توکن و Context صرف خواندن تصویر، جدول و ترتیب صفحات میشود.
Unlimited-OCR از Baidu این کار را قبل از مدل انجام میدهد:
📄 PDF خام
⬇️
⚡ متن و Markdown ساختاریافته
⬇️
🤖 ارسال فقط بخشهای مهم به Claude یا Codex
نتیجه:
✅ توکن و هزینه کمتر
✅ پاسخ سریعتر
✅ Context بیشتر برای تحلیل واقعی
✅ مناسب برای RAG، Agentها و اسناد طولانی
این مدل متن، جدول، فرمول و ترتیب خواندن دهها صفحه را یکجا استخراج میکند؛ یعنی بهجای خفهکردن مدل با فایل خام، فقط اطلاعات ارزشمند را به آن میدهیم.
🔗 GitHub:
https://github.com/baidu/Unlimited-OCR
📄 Paper:
https://arxiv.org/abs/2606.23050
Post #199
488

- ❤ 4