☑️
تشخیص متن با استفاده از OCR در پایتون: سریع، دقیق، آسان📦 نصب:
pip install pytesseract pillow
📌همچنین، باید خود
موتور Tesseract OCR را نصب کنید کلیک.
📄 استفاده پایه:
from PIL import Image
import pytesseract
img = Image.open("scan.png")
text = pytesseract.image_to_string(img, lang="rus+eng")
print(text)
⬅️ ؛
Tesseract متن را در تصویر "میبیند" و آن را به صورت یک رشته برمیگرداند. از دهها زبان پشتیبانی میکند.
🔳
ویژگیهای اضافی:1⃣ خواندن از یک ناحیه خاص از تصویر:
area = img.crop((x1, y1, x2, y2))
text = pytesseract.image_to_string(area)
⬅️ این روش زمانی مفید است که فقط به بخشی از تصویر (مانند یک شماره یا عنوان) علاقه دارید.
2⃣ دریافت ساختار:
data = pytesseract.image_to_data(img, output_type=pytesseract.Output.DICT)
⬅️ این روش کلمات، مختصات و سطح تودرتو را برمیگرداند. میتوانید از آن برای هایلایت کردن متن در تصویر استفاده کنید.
3⃣
کار با PDF:from pdf2image import convert_from_path
pages = convert_from_path("doc.pdf")
for page in pages:
print(pytesseract.image_to_string(page))
⬅️ ابتدا فایل PDF را به تصاویر تبدیل میکنیم و سپس آنها را پردازش میکنیم.
📌 تنظیمات مفید:
▫️
lang="en"انتخاب زبان Lang = en بهتر است به طور صریح مشخص شود
▫️
config="--psm 6" تنظیمات مربوط به ساختار صفحه (حالتهای PSM: از 0 تا 13، به مستندات مراجعه کنید)
🖥 @devloper98