tengo una página donde quiero extraer un número ean de una etiqueta de secuencia de comandos (aquí está 8806090571589)
Traté de obtener el guión en primer lugar con
jsonn = r.html.find('script')[3].text print(title, price, jsonn)sin embargo, eso no funcionó.
el código fuente de la página está aquí (demasiado largo para publicar):
ver fuente: https://www.kaufland.de/product/361834606/?search_value=waschmaschine
Cuando usa find(), devolverá solo la primera aparición de la etiqueta. Como puedo ver que necesita encontrar la cuarta ocurrencia, necesita usar la función findAll(). Devolverá una lista de todas las ocurrencias y luego puede usar cualquier ocurrencia según sus necesidades.
Intenté usar el siguiente código en mi computadora:
import urllib3 from bs4 import BeautifulSoup URL = "https://www.kaufland.de/product/361834606/?search_value=waschmaschine" response = urllib3.PoolManager().request("GET", URL, headers={'User-Agent' : "python"}) soup = BeautifulSoup(response.data.decode('utf-8'), 'html.parser') print(soup.findAll("script")[3])Puede tomar este código como referencia y modificarlo según sus necesidades.