اگه نیاز دارید که OCR یا استخراج اطلاعات از فایلهای PDF در اسکیل بالا انجام بدید بهترین راه اینه که pipeline خودتون را داشته باشید با مدلهای اپن سورس. اینجوری هم هزینه بسیار پایین میاد و هم اینکه از لحاظ امنیت و privacy دیگه نگران نیستید که اطلاعات بره روی cloud یک شرکت دیگه.
این بلاگ را بخونید که هزینه این کار برای ۱۱۶۰۰۰ صفحه کمتر از ۵ دلار شده در مقایسه با ۱۱۶۰ دلار اگه از Azure استفاده میکردند.
Blg: https://blueguardrails.com/en/blog/high-throughput-vlm-ocr
@DevTwitter | <Mehdi Allahyari/>
Post #12475
7.35K

- 👍 31
- ❤ 7
- 🍌 4