این یه اسکریپت ساده پایتون برای تبدیل فایلهای PDF به فرمت DOCX هست!
📦 کد اسکریپت
from pdf2docx import Converter
import os
def pdf_to_docx(pdf_path, docx_path=None):
"""
تبدیل فایل PDF به فرمت DOCX
"""
# اگر مسیر DOCX مشخص نشده باشه، از نام فایل PDF استفاده میکنیم
if docx_path is None:
docx_path = pdf_path.replace('.pdf', '.docx')
try:
# ایجاد کانورتر
cv = Converter(pdf_path)
# تبدیل فایل
cv.convert(docx_path)
# بستن کانورتر
cv.close()
print(f"✅ فایل با موفقیت تبدیل شد!")
print(f"📁 مسیر فایل: {docx_path}")
except Exception as e:
print(f"❌ خطا: {e}")
# استفاده از اسکریپت
if __name__ == "__main__":
pdf_file = input("مسیر فایل PDF: ")
pdf_to_docx(pdf_file)
🎯 نحوه استفاده
۱. نصب کتابخانههای مورد نیاز:
pip install pdf2docx
۲. اجرای اسکریپت:
python pdf_to_docx.py
۳. وارد کردن مسیر فایل:
مسیر فایل PDF: /path/to/file.pdf
💡 برای PDFهای اسکن شده، از OCR استفاده کن:
# نصب: pip install pytesseract pillow
import pytesseract
from PIL import Image
import pdf2image
def pdf_to_text(pdf_path):
images = pdf2image.convert_from_path(pdf_path)
text = ""
for img in images:
text += pytesseract.image_to_string(img, lang='fas')
return text
🆔 @python4all_pro
🧩لینک کانال در بله 👇👇
https://ble.ir/Python4all_pro