TGViewer
Python Academy Python Academy @python_academy · 44.3K subscribers
Post #2511 6.1K
Читаем текст с картинки используя Tesseract от Google

Google разработал систему Tesseract для извлечения текста из изображений через оптическое распознавание символов.

Pytesseract - это удобная оболочка для системы Tesseract, облегчающая её использование.

Чтобы извлечь текст из изображения, используйте метод image_to_string. Для работы с русским текстом укажите аргумент lang как 'rus'.

Рекомендуется использовать библиотеку pillow для открытия изображений, хотя можно также просто указать путь к файлу.

Пример кода:

from PIL import Image
import pytesseract

# Открываем изображение с помощью Pillow
image = Image.open('image.jpg')

# Используем pytesseract для извлечения текста
text = pytesseract.image_to_string(image, lang='rus')

print(text)

#python #pytesseract
  • 👍 2
  • ❤ 1
  • 👎 1
More from @python_academy
  1. Sep 23, 2026Возврат нескольких значений из функции Знаете ли вы, что можно осуществлять возврат нескол…
  2. Sep 22, 2026Получение срезов итераторов Если вы попытаетесь получить срез итератора, то столкнётесь с…
  3. Sep 21, 2026Хэширование Хэш — это целое число фиксированного размера, которое идентифицирует определен…
  4. Sep 20, 2026Понимание различий между операторами сравнения == и is Множество разработчиков сталкиваютс…
  5. Sep 19, 2026Быстрый deque deque предпочтительнее, чем обычный список, когда нужны более быстрые операц…
  6. Sep 19, 2026⁠Упаковка параметров с помощью urlencode Довольно часто приходится работать с разнообразны…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →