🚀 تحولی در پردازش اسناد با مدل LightOnOCR-2-1B
محققان هوش مصنوعی به تازگی مدلی با تنها ۱ میلیارد پارامتر ارائه کردهاند که در پردازش OCR، سیستمهای ۹ برابر بزرگتر از خود را پشت سر میگذارد. این مدل به جای خطلولههای پیچیده و چندمرحلهای، اسناد را به صورت یکپارچه (End-to-End) پردازش کرده و مستقیماً به متن تبدیل میکند.
از مهمترین ویژگیهای این مدل میتوان به موارد زیر اشاره کرد:
- کسب نمره SOTA در بنچمارک OlmOCR و سرعت ۳.۳ برابری نسبت به مدل Chandra.
- قابلیت تشخیص دقیق جداول، رسیدها، فرمها و فرمولهای ریاضی با خروجی استاندارد LaTeX.
- بهرهوری خیرهکننده با هزینه کمتر از یک سنت برای هر ۱۰۰۰ صفحه روی کارت گرافیک H100.
- پشتیبانی از ۱۱ زبان زنده دنیا و قابلیت اجرا روی ابزارهایی مانند Ollama و vLLM.
این پروژه تحت لایسنس Apache 2.0 به صورت کاملاً متنباز منتشر شده و با توانایی پردازش نیممیلیون صفحه در روز روی یک GPU، استاندارد جدیدی برای پردازش اسناد تعریف کرده است.
LightOnOCR-2-1B: مدل قدرتمند هوش مصنوعی برای تبدیل اسناد به متن با سرعت و هزینه بینظیر
📊 Data➕Science
Post #3504
268
