Quiero obtener el html de esta página para analizar (haga clic en el enlace para comprender qué contenido quiero obtener).
Aquí está mi código para solicitar el contenido de esta página
var https = require("https"); var fs = require("fs"); var options = { hostname: "www.prizebond.net", port: 443, path: "/dlist.php?num=455", method: "GET" }; var response = ""; var req = https.request(options, function (res) { res.setEncoding("UTF-8"); console.log(res.statusCode); res.on("data", function (chunk) { response += chunk; }); res.on("end", function () { fs.writeFile("750-bond.html", response, function (err) { if (err) { console.log(err.message); } console.log("File downloaded"); }); console.log("end"); }); }); req.end();Ahora, el problema es que en mi archivo 750-bont.html, obtengo el resultado extraño de " Verificar su navegador antes de acceder a Prizebond.net ", no el contenido original. Aquí está la captura de pantalla que obtuve cuando abrí el archivo 750-bond.html en el navegador.
¿Que estoy haciendo mal? ¿Y cómo puedo obtener el contenido original de esta página web?
No puedes, a menos que escribas algo más sofisticado, pero probablemente no deberías.
El propósito de la protección de Cloudflare es evitar lo que, lamentablemente, está tratando de realizar.
Podría considerar la posibilidad de acceder a lo que desee mediante una API pública o algo que proporcione Prizebond.net, por ejemplo.