Intenté usar varias aplicaciones/en línea para convertir archivos PDF a HTML, con fines de prueba. Sin embargo, cuando inspecciono el archivo después de la conversión, veo algo como esto:
<div class="t m0 x2 h5 y4 ff1 fs3 fc1 sc0 ls0 ws0">Investment det<span class="_ _0">. </span>ails</div> Como puede ver, Investment det y las ails se han separado, y a veces puede haber símbolos aún más extraños entre palabras como cuadrados, etc. ( umNer )
¿Significa esto que para crear PDF se utilizó algún tipo de codificador? ¿O el código que creó el PDF estaba mal escrito? ¿Quizás incluso alguien pueda darme alguna sugerencia sobre cómo abordar esta situación? ¿O es un problema del convertidor y tengo que seguir buscando un mejor convertidor?
Como sé, se utilizó react-pdf para crear un archivo PDF. Al menos eso es lo que dice el propio archivo.