🚀 معرفی مدل قدرتمند Jina-OCR برای تحلیل اسناد
تیم Jina AI نسخه جدید jina-ocr-v1 را منتشر کرده است. این مدل ۳ میلیارد پارامتری به طور ویژه برای پردازش اسناد در سیستمهای مقرونبهصرفه بهینه شده و میتواند تصاویر، فایلهای PDF و اسکنها را به فرمت Markdown با پشتیبانی از LaTeX تبدیل کند.
از قابلیتهای کلیدی این مدل میتوان به موارد زیر اشاره کرد:
- استخراج جداول و فرمولهای پیچیده
- پاسخگویی به سوالات متنی بر اساس محتوای سند
- استخراج فیلدهای کلیدی و زیرنویسنویسی تصاویر
- نرخ پردازش عالی با توانایی تحلیل ۲.۵۷ صفحه در ثانیه روی کارت گرافیک A100
معماری این مدل بر پایه DeepSeek-OCR است و از تکنیک FastMTP برای افزایش سرعت استنتاج بهره میبرد. برای استفاده از این قابلیت، اطمینان حاصل کنید که از نسخه ۰.۲۱ vLLM یا جدیدتر استفاده میکنید.
شما میتوانید برای بررسی عملکرد مدل از دموی آنلاین استفاده کنید یا مستندات فنی و مقالات مرتبط را در Arxiv مطالعه کنید. دسترسی به وزنهای مدل نیز در Hugging Face برای علاقهمندان فراهم شده است.
بررسی مدل Jina-OCR-v1: پردازش هوشمند اسناد با بهینهسازی سرعت و دقت
Post #3568
290


