Estoy buscando ayuda para ejecutar solicitudes-html en Python con ExpressVPN. Estoy tratando de extraer los datos del título de la página de un sitio que muestra el contenido en JavaScript. Puedo cargar las páginas web en mi navegador con mi VPN activada, pero no puedo obtener los datos del título de la página cuando intento ejecutar el siguiente código en Python con la VPN activada. He buscado en otros hilos pero no he podido resolver este problema hasta ahora, ¡cualquier consejo sería muy apreciado!
Intenté copiar la información del encabezado como se sugiere en esta publicación, pero definir los datos del encabezado como se encuentran en la pestaña de herramientas de desarrollo de la red no resolvió mi problema. Las solicitudes de Python no obtienen el sitio web que se abre en el navegador
from requests_html import HTMLSession from bs4 import BeautifulSoup session = HTMLSession(browser_args=["--no-sandbox", "--user-agent=Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/100.0.4896.88 Safari/537.36"]) url = "https://www.url.com" resp = session.get(url) resp.html.render(sleep=10) resp.html.html soup = BeautifulSoup(resp.html.html, "lxml") option_tags = soup.find_all("title") print(option_tags)