chandra
При работе с текстом в PDF и изображениях — особенно в документах, где вперемешку идут таблицы, формулы и рукописный текст — результаты традиционного OCR часто превращаются в полный хаос, с потерей всей разметки.
Сегодня наткнулся на ещё одну новую open-source модель OCR: Chandra OCR 2. Она умеет напрямую конвертировать изображения и PDF в структурированные Markdown, HTML или JSON, при этом сохраняя исходный layout.
Поддерживает более 90 языков и заняла первое место в комплексном leaderboard’е по мультиязычному OCR, показывая сильные результаты в распознавании математических формул, сложных таблиц и рукописного текста.
Одна из самых практичных фич — точное восстановление структуры форм, включая такие детали, как чекбоксы, а также возможность извлекать графики из документов и автоматически генерировать их описания. Одной командой можно обрабатывать как один файл, так и целую директорию.
Если ты часто конвертируешь сканы, научные статьи или мультиязычные документы в редактируемые форматы — стоит попробовать: точность распознавания китайского языка достигает примерно 89%.
📁 Language: #Python 76.8%
⭐️ Stars: 7.6k
➡️ Cсылка на GitHub
📱 @git_developer
Post #1509
2.97K

- 👍 4
- 🤔 2