TGViewer
Zen of Python Zen of Python @zen_of_python · 18.8K subscribers
Post #2729 5.77K
​pdfplumber для извлечения текста с .pdf

Утилита, считывающая текст с документов на нескольких языках, включая русский:

import pdfplumber

with pdfplumber.open("path/to/file.pdf") as pdf:
first_page = pdf.pages[0]
print(first_page.chars[0])

Репозиторий

#OCR #библиотека
  • 👍 11
  • ❤‍🔥 3
More from @zen_of_python
  1. Oct 9, 2026Как добавить MCP-сервер в Django-проект django-mcpz позволяет зарегистрировать Python-функ…
  2. Oct 9, 2026Как дождаться обработки очереди asyncio Пустая очередь ещё не означает, что работа законче…
  3. Oct 9, 2026Почему frozendict не замораживает вложенные объекты В Python 3.15 появляется встроенный fr…
  4. Oct 8, 2026Почему цикл внутри теста скрывает часть ошибок Тест перебирает десять входов и проверяет р…
  5. Oct 8, 2026Как выполнять CPU-задачи в отдельных интерпретаторах Python В Python 3.14 InterpreterPoolE…
  6. Oct 8, 2026Как отличить отсутствие аргумента от None в Python Если None — допустимое значение настрой…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →