Empresas
Empregos
  • Sobre nós
  • Soluções
    • Publicação de vagas
      Publique sua vaga e receba candidatos qualificados em 48h.
    • Avaliações de candidatos
      Mais de 500 testes técnicos e psicológicos, mais anti-fraude.
    • Headhunting
      Busca executiva personalizada do início ao fim.
    • Folha de Pagamento + EOR
      Dispersão de folha e EOR em mais de 15 países da LATAM.
  • Preços
  • Empregos

0

229
Visualizações
raspado web; ¿Cómo renderizar html después de ejecutar javascript?

Estoy tratando de obtener una lista de empresas de tecnología en Greater Noida de 'GlassDoor':

pero Problema: la página cambia su contenido después de algunos segundos de carga (puede estar usando javascript).

Enlace: https://www.glassdoor.co.in/Explore/browse-companies.htm?overall_rating_low=3.5&page=1&isHiringSurge=0&locId=4475367&locType=C&locName=Greater%20Noida

puede cambiar el valor de la página en el enlace... pruébelo. después de cambiar la página no. Estoy renderizando el mismo contenido de la primera página... ¡después de cambiar el número de página!

 from bs4 import BeautifulSoup from selenium import webdriver lst=[] options = webdriver.ChromeOptions() options.add_argument('--headless') browser = webdriver.Chrome(options=options, executable_path='chromedriver.exe') browser.get("https://www.glassdoor.co.in/Explore/browse-companies.htm?overall_rating_low=3.5&page=8&isHiringSurge=0&locId=4475367&locType=C&locName=Greater%20Noida") html = browser.page_source soup = BeautifulSoup(html, features="html.parser") company_lst = soup.find_all('section', {'class': 'employerCard__EmployerCardStyles__employerCard'}) for item in company_lst: d={} d['Name'] = item.find('h2', {'data-test': 'employer-short-name'}).text d['Rating'] = item.find('span', {'data-test': 'rating'}).text d['Reviews-Count'] = item.find('div', {'data-test': 'cell-Reviews-count'}).text d['Salaries-Count'] = item.find('div', {'data-test': 'cell-Salaries-count'}).text d['Jobs-Count'] = item.find('div', {'data-test': 'cell-Jobs-count'}).text d['Industry'] = item.find('span', {'data-test': 'employer-industry'}).text print(d['Name'])
about 4 years ago · Juan Pablo Isaza
1 Respostas
Responde à pergunta

0

No estoy seguro de por qué la página se vuelve a cargar a la primera página. Pero puede intentar hacer clic en los botones de número de página como se muestra a continuación (que funciona bien).

 browser.get("https://www.glassdoor.co.in/Explore/browse-companies.htm?overall_rating_low=3.5&page=1&isHiringSurge=0&locId=4475367&locType=C&locName=Greater%20Noida") for i in range(2,8): browser.find_element_by_xpath("//ul[contains(@class,'pagination')]//li/button[text()='{}']".format(i)).click() print(browser.current_url) # Prints the URL from page 2 to 7. time.sleep(5)
about 4 years ago · Juan Pablo Isaza Relatório
Responde à pergunta
Encontrar trabalhos remotos

Descubra a nova forma de encontrar um emprego!

melhores empregos
Principais categorias de trabalho
Empresas
Postar vaga Preços Comercial
Jurídico
Termos e Condições Política de privacidade
© 2026 PeakU Inc. All Rights Reserved.
Andres GPT
Recomende algumas ofertas para mim
Preciso de ajuda