Para comenzar, quería raspar esta tabla que se carga desde el script Java y solo quiero raspar una fila específica de datos, como la base en la abreviatura del Fondo o la base de búsqueda en eso, pero mi script básico aquí no funciona bien. por favor ayuda
from bs4 import BeautifulSoup from requests_html import HTMLSession session = HTMLSession() url = 'https://www.publicmutual.com.my/Our-Products/UT-Fund-Prices' r = session.get(url) r.html.render() soup=BeautifulSoup(r.html.html,'html.parser') table = soup.find('table', attrs={'class':'fundtable col-sm-12'}) print(table)¿Cómo hago que esto funcione y extraiga información solo de ciertas filas que quería según el nombre del fondo o la columna de abreviatura del fondo?
Si ingresa a chromedevtools y verifica la URL que representa la tabla, verá el html de la tabla de la siguiente manera: HTML
El sitio web realiza una solicitud posterior para obtener los datos.
Si necesita que su aplicación de raspado sea rápida, debe mapear la carga útil y raspar con python-requests y bs4. Si la velocidad no es un problema, puede usar python-Selenium