Como traducir documentos PDF a 9 idiomas con Python
Copiar parrafos de un PDF en Google Translate es una tortura. Lo resolvi con Python.
El problema
Traducir un contrato o paper de 20 paginas a mano tarda 45 minutos. Cada parrafo se copia, se pega, se espera.
La solucion: deep-translator + pdfplumber
Instalacion:
pip install deep-translator pdfplumber
El codigo
python
from deep_translator import GoogleTranslator
import pdfplumber
def traducir_pdf(ruta, origen, destino):
with pdfplumber.open(ruta) as pdf:
texto = "\n".join(p.extract_text() or "" for p in pdf.pages)
traductor = GoogleTranslator(source=origen, target=destino)
lineas = texto.split("\n")
traducidas = []
for linea in lineas:
if linea.strip():
traducidas.append(traductor.translate(linea) or linea)
else:
traducidas.append("")
resultado = "\n".join(traducidas)
with open("traducido.txt", "w", encoding="utf-8") as f:
f.write(resultado)
traducir_pdf("documento.pdf", "en", "es")
## Resultado
Traduccion de un contrato de 20 paginas en 30 segundos (vs 45 minutos manual).
## Idiomas soportados
Espanol, ingles, portugues, frances, aleman, italiano, ruso, japones y chino.
## Consideraciones
**Linea por linea:** Traducir cada linea mantiene el formato. Si traduces todo de golpe, Google corta a los 5,000 caracteres y pierdes los saltos.
**PDFs escaneados:** No funcionan si son imagenes. Necesitas OCR.
**Conexion:** Requiere internet (usa servidores de Google).
## Conclusion
Traducir documentos completos en 30 segundos es una realidad con Python.
Si quieres la version completa con menu interactivo y 9 idiomas:
[Traductor Automatico de Documentos](https://lfdocean.gumroad.com/l/traductor-documentos-ia)
Top comments (0)