nerdemma

Tesseract OCR Py

Sep 22nd, 2025
149
0
Never
Not a member of Pastebin yet? Sign Up, it unlocks many cool features!
Python 1.29 KB | None | 0 0
  1. import os
  2. import shutil
  3. from PIL import Image
  4. import pytesseract
  5.  
  6. def analizar_imagenes(carpeta_origen, carpeta_destino):
  7.     # Crear carpeta destino si no existe
  8.     if not os.path.exists(carpeta_destino):
  9.         os.makedirs(carpeta_destino)
  10.  
  11.     # Recorremos los archivos de la carpeta origen
  12.     for archivo in os.listdir(carpeta_origen):
  13.         if archivo.lower().endswith(('.jpg', '.jpeg')):
  14.             ruta = os.path.join(carpeta_origen, archivo)
  15.  
  16.             try:
  17.                 # Abrimos imagen y aplicamos OCR
  18.                 texto = pytesseract.image_to_string(Image.open(ruta))
  19.  
  20.                 if texto.strip():  # Si se detecta algún texto
  21.                     destino = os.path.join(carpeta_destino, archivo)
  22.                     shutil.move(ruta, destino)
  23.                     print(f"[+] Movido: {archivo} -> contiene texto")
  24.                 else:
  25.                     print(f"[-] Ignorado: {archivo} -> sin texto detectado")
  26.  
  27.             except Exception as e:
  28.                 print(f"[!] Error procesando {archivo}: {e}")
  29.  
  30.  
  31. if __name__ == "__main__":
  32.     carpeta_origen = input("Ingrese la ruta de la carpeta origen: ").strip()
  33.     carpeta_destino = input("Ingrese la ruta de la carpeta destino: ").strip()
  34.  
  35.     analizar_imagenes(carpeta_origen, carpeta_destino)
  36.  
Advertisement
Add Comment
Please, Sign In to add comment