Открыли репозиторий с современным веб-приложением OCR: фронтэнд на React, бэкенд на FastAPI.
Что умеет:
- Plain OCR — извлечение текста из изображения
- Describe — генерация описания изображения
- Find — поиск заданного термина с отображением рамки
- Freeform — задаёшь кастомный prompt и получаешь результат
Почему круто:
- Drag-and-drop загрузка изображений до 100 МБ, визуализация bounding boxes
- Конфигурация через .env (порт, размер файла, модель)
- Стек: React 18 + Vite + TailwindCSS + FramerMotion + FastAPI + PyTorch + Transformers
- Всё контейнеризовано через Docker + Docker Compose → можно быстро запустить
Как начать:
1. Клонируй репозиторий
2. Cкопируй
.env.example в .env и настрой параметры 3. Запусти:
docker compose up --build 4. Открой: фронтэнд (по умолчанию http://localhost:3000) & API (http://localhost:8000)
https://github.com/rdumasia303/deepseek_ocr_app/
