Estoy tratando de probar un método en el que puedo intentar extraer archivos de una carpeta específica en un sitio web, por ejemplo:
El contenido que quiero rastrear está en esta carpeta específica: ejemplo.com/assets/nombre de archivo-xxx.js Hay 40-50 archivos como este, pero todos tienen números diferentes como sufijo.
¿Cómo puedo configurar un método usando NodeJS agregando condicionalmente el bucle for para agregar un número aleatorio y ver si hay una coincidencia para descargar el archivo? Si no hay una coincidencia, se omitirá y pasará al siguiente número. técnicamente, esto tendrá que ejecutarse 999 veces como máximo.
Actualmente, estoy usando el raspador de sitios web y el código actual
const scrape = require('website-scraper'); const websiteUrl = 'http://example.com/assets/'; scrape({ urls: [websiteUrl], urlFilter: function (url) { return url.indexOf(websiteUrl) === 0; }, recursive: true, maxDepth: 50, prettifyUrls: true, filenameGenerator: 'bySiteStructure', directory: './node-website' }).then((data) => { console.log("Entire website succesfully downloaded"); }).catch((err) => { console.log("An error ocurred", err); });Sin embargo, esto no funciona porque solo sigue enlaces, ¿alguna idea sobre una solución?
Puedes probar https://pptr.dev/ (Titiritero)
Paquete npm ( https://www.npmjs.com/package/puppeteer )
Esto funciona para mi