Business
Jobs
  • About Us
  • Solutions
    • Job Postings
      Post your job and receive qualified candidates in 48h.
    • Candidate Assessments
      500+ technical and psychological tests, plus anti-fraud.
    • Headhunting
      Tailor-made executive search from start to finish.
    • Payroll + EOR
      Payroll dispersal and EOR across 15+ LATAM countries.
  • Pricing
  • Jobs

0

121
Views
bucle de eventos vs subprocesos de trabajo para el rastreador web en nodejs

Estoy tratando de construir un rastreador web con NodeJS. Estoy debatiendo cuál es la forma más eficiente de implementar el rastreador para la escala y la gran cantidad de solicitudes.

Supongamos que solo enviamos 1 solicitud para rastrear una página web y todas las URL dentro de ella, y repitamos el proceso hasta que se rastreen X profundidad o Y URL.

Se me ocurrieron 2 opciones de diseño (worker-threads vs event loop):

  1. Una cola que contiene las direcciones URL. Para cada URL en la cola, creo un subproceso de trabajo (de un grupo) para ejecutar la tarea de rastreo y cada vez que veo un enlace, se agregará a la cola.

  2. Use el bucle de eventos nativo, de modo que para cada URL en la página HTML ejecutaré la misma función asíncrona de forma recursiva

También planeo leer las páginas HTML como un flujo. ¿Cuál es mejor en términos de rendimiento?

También me gustaría saber si cada subproceso de trabajo tiene su propio ciclo de eventos.

about 4 years ago · Juan Pablo Isaza
Answer question
Find remote jobs

Discover the new way to find a job!

Top jobs
Top job categories
Business
Post vacancy Pricing Sales
Legal
Terms and conditions Privacy policy
© 2026 PeakU Inc. All Rights Reserved.
Andres GPT
Show me some job opportunities
There's an error!