Empresas
Empleos
  • Sobre nosotros
  • Soluciones
    • Publicación de vacantes
      Publica tu vacante y recibe candidatos calificados en 48h.
    • Evaluación de candidatos
      500+ pruebas técnicas y psicológicas, más anti-fraude.
    • Headhunting
      Búsqueda ejecutiva a la medida de principio a fin.
    • Nómina + EOR
      Dispersión de nómina y EOR en más de 15 países de LATAM.
  • Precios
  • Empleos

0

110
Vistas
Problema con el archivo de lectura pdf desde URL nodeJS

Estoy usando pdf.js-extract para leer el archivo pdf de datos desde la URL. Este es mi código y funciona bien:

 const fs = require('fs'); const PDFExtract = require('pdf.js-extract').PDFExtract; const pdfExtract = new PDFExtract(); const https = require('https'); const url = 'https://www.w3.org/WAI/ER/tests/xhtml/testfiles/resources/pdf/dummy.pdf' const readData = async (url) => { https.get(url, async function (response) { const file = fs.createWriteStream('./dummy.pdf'); response.pipe(file); file.on("finish", () => { pdfExtract.extract('./dummy.pdf', {}) .then(async function(data) { console.log(data) }); file.close(); fs.unlinkSync('./dummy.pdf') }); }); } readData(url)

Pero tengo 2 problemas con este código.

  1. La primera es que, ¿cómo puedo lidiar con si la URL cambia de https a http? Intento buscar el nodo pero parece que no funciona como esperaba.
  2. La segunda es que el código tarda demasiado en manejarse si el archivo pdf es grande, unos 5 segundos para 2 Mbs. Me pregunto si hay una forma más rápida como leer el archivo del búfer o algo así sin tener que guardarlo como un archivo temporal.

Gracias por tu atención

about 4 years ago · Juan Pablo Isaza
Responde la pregunta
Encuentra empleos remotos

¡Descubre la nueva forma de encontrar empleo!

Top de empleos
Top categorías de empleo
Empresas
Publicar vacante Precios Comercial
Legal
Términos y condiciones Política de privacidad
© 2026 PeakU Inc. All Rights Reserved.
Andres GPT
Recomiéndame algunas ofertas
Necesito ayuda