Business
Jobs
  • About Us
  • Solutions
    • Job Postings
      Post your job and receive qualified candidates in 48h.
    • Candidate Assessments
      500+ technical and psychological tests, plus anti-fraud.
    • Headhunting
      Tailor-made executive search from start to finish.
    • Payroll + EOR
      Payroll dispersal and EOR across 15+ LATAM countries.
  • Pricing
  • Jobs

0

114
Views
Problema con el archivo de lectura pdf desde URL nodeJS

Estoy usando pdf.js-extract para leer el archivo pdf de datos desde la URL. Este es mi código y funciona bien:

 const fs = require('fs'); const PDFExtract = require('pdf.js-extract').PDFExtract; const pdfExtract = new PDFExtract(); const https = require('https'); const url = 'https://www.w3.org/WAI/ER/tests/xhtml/testfiles/resources/pdf/dummy.pdf' const readData = async (url) => { https.get(url, async function (response) { const file = fs.createWriteStream('./dummy.pdf'); response.pipe(file); file.on("finish", () => { pdfExtract.extract('./dummy.pdf', {}) .then(async function(data) { console.log(data) }); file.close(); fs.unlinkSync('./dummy.pdf') }); }); } readData(url)

Pero tengo 2 problemas con este código.

  1. La primera es que, ¿cómo puedo lidiar con si la URL cambia de https a http? Intento buscar el nodo pero parece que no funciona como esperaba.
  2. La segunda es que el código tarda demasiado en manejarse si el archivo pdf es grande, unos 5 segundos para 2 Mbs. Me pregunto si hay una forma más rápida como leer el archivo del búfer o algo así sin tener que guardarlo como un archivo temporal.

Gracias por tu atención

about 4 years ago · Juan Pablo Isaza
Answer question
Find remote jobs

Discover the new way to find a job!

Top jobs
Top job categories
Business
Post vacancy Pricing Sales
Legal
Terms and conditions Privacy policy
© 2026 PeakU Inc. All Rights Reserved.
Andres GPT
Show me some job opportunities
There's an error!