Estoy tratando de reemplazar texto en PDF Tenemos una gran cantidad de archivos PDF (más de 900k) que necesitan reemplazo de texto, solo en la primera página
Nombre, dirección correo electrónico y número
También probé muchas soluciones con Python y Perl, pero encontré diferentes errores, "índice no encontrado", "el códec no puede decodificar", etc.
La única solución que funcionó hasta ahora es asposepdfcloud api. que es una API basada en la nube y no sé qué está pasando detrás. y No podemos procesar nuestros archivos a través de una API externa debido a problemas de privacidad.
Estaba dudando si hay algo similar a esto.
También tengo un bot que usa uipath, que abre el archivo PDF en Acrobat pro y busca y reemplaza y luego guarda el documento, pero todo este proceso toma alrededor de 1 minuto para 1 archivo como mínimo. Así que esta no es una solución adecuada para la gran cantidad de archivos.
Cualquier ayuda sería apreciada. PD Actualmente no es posible reemplazar el texto antes de crear y volver a generar todos los archivos PDF.
Una de las formas posibles de resolver este problema es encontrar la sección que desea reemplazar usando "regex". Luego, use una de las bibliotecas para la edición de PDF (como "pdfplumber") en python para reemplazar esta sección.
Los errores que está recibiendo son posibles de manejar. Si no molesta la privacidad, puedo echar un vistazo a uno de estos PDF y proporcionar una solución más detallada.