🔖 DeepSeek-OCR можно дообучить под любой язык на одной GPU
Модель использует optical context compression — вместо длинных последовательностей токенов документ сжимается в визуальные токены.
На эксперименте с персидским языком CER улучшили на 88% всего за 60 шагов обучения.
Весь код и окружение полностью open-source.
⛓️ Ссылка на ресурс
tags: #полезное
➡ Data Scientist | Чат | ИИ-Бот
Post #908
687
- 🔥 2