📜 Datalab выпустили лучшую OCR-модель — Chandra максимально точно извлекает всё содержимое из любых изображений и PDF-документов.
• Превращает фотки и файлы в структурированные форматы HTML, Markdown и JSON.
• Сохраняет макет и отлично вытаскивает таблицы, формулы, диаграммы и даже рукописный текст.
• Поддерживает более 40 языков.
• Возглавляет все независимые бенчмарки, обгоняя DeepSeek OCR, Mistral OCR и других конкурентов.
• Модель Chandra доступна как локально, так и удалённо.
GitHub — здесь, а бесплатная демка — тут.
@notboring_tech
Post #3895
7.88K
- 🔥 31
- 🎉 14
- 🤯 6
- ❤🔥 4
- 👍 4