TGViewer
هوش مصنوعی و علم داده به فارسی هوش مصنوعی و علم داده به فارسی @dataplusscience · 6.06K subscribers
Post #3568 290
‏🚀 معرفی مدل قدرتمند Jina-OCR برای تحلیل اسناد

‏تیم Jina AI نسخه جدید jina-ocr-v1 را منتشر کرده است. این مدل ۳ میلیارد پارامتری به طور ویژه برای پردازش اسناد در سیستم‌های مقرون‌به‌صرفه بهینه شده و می‌تواند تصاویر، فایل‌های PDF و اسکن‌ها را به فرمت Markdown با پشتیبانی از LaTeX تبدیل کند.

‏از قابلیت‌های کلیدی این مدل می‌توان به موارد زیر اشاره کرد:
‏- استخراج جداول و فرمول‌های پیچیده
‏- پاسخگویی به سوالات متنی بر اساس محتوای سند
‏- استخراج فیلدهای کلیدی و زیرنویس‌نویسی تصاویر
‏- نرخ پردازش عالی با توانایی تحلیل ۲.۵۷ صفحه در ثانیه روی کارت گرافیک A100

‏معماری این مدل بر پایه DeepSeek-OCR است و از تکنیک FastMTP برای افزایش سرعت استنتاج بهره می‌برد. برای استفاده از این قابلیت، اطمینان حاصل کنید که از نسخه ۰.۲۱ vLLM یا جدیدتر استفاده می‌کنید.

‏شما می‌توانید برای بررسی عملکرد مدل از دموی آنلاین استفاده کنید یا مستندات فنی و مقالات مرتبط را در Arxiv مطالعه کنید. دسترسی به وزن‌های مدل نیز در Hugging Face برای علاقه‌مندان فراهم شده است.

بررسی مدل Jina-OCR-v1: پردازش هوشمند اسناد با بهینه‌سازی سرعت و دقت
More from @dataplusscience
  1. Sep 30, 2026‏📊 الگوهای طراحی در یادگیری ماشین ‏کتاب Machine Learning Design Patterns مجموعه‌ا…
  2. Sep 30, 2026‏📚 کتاب الگوهای طراحی یادگیری ماشین ‏کتاب «Machine Learning Design Patterns» که ت…
  3. Sep 30, 2026‏جزوات معماری GPU و برنامه‌نویسی CUDA ‏دانشگاه استنفورد جزوات کامل درس معماری GPU…
  4. Sep 30, 2026‏📊 کاهش فاصله زمانی انتشار مدل‌های Anthropic و OpenAI ‏فاصله زمانی بین انتشار مدل…
  5. Sep 30, 2026‏🤖 معرفی Dots توسط OpenAI ‏شرکت OpenAI از «Dots» رونمایی کرد؛ ایجنت‌های هوش مصنوع…
  6. Sep 30, 2026‏💰 اهداف مالی آنتروپیک برای عرضه عمومی سهام ‏اسناد فاش‌شده از برنامه‌های Anthropi…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →