Chandra от Datalab: Новая OCR-модель для точного извлечения текста из документов PDF или изображений
Достаточно просто закинуть файл, и Chandra превратит его в структурированные форматы, такие как HTML, Markdown и JSON. Также тулса поддерживает более 40 языков. А в тестах даже DeepSeek, Mistral и других ближайших конкурентов. Ну и что самое главное, она абсолютно бесплатная.
Ставим локально с GitHub или пользуемся онлайн — здесь.
@HotCodeIT
Post #2583
4.28K
- ❤ 10