Estoy trabajando en un script de python que importa sopa hermosa, solicitudes y API urllib.request para obtener imágenes de la dirección https://www.example.com/image.jpg y funciona bien, incluyéndolas en mi carpeta de documentos bien numerado.
Probé varios métodos enumerados aquí, pero ninguno parece haber ayudado, en Google, la solución giraba en torno a obtener etiquetas.
La pregunta es cómo programarlo para obtener imágenes de mi ejemplo.html ubicado en mi unidad C:/ usando el script de python mencionado, donde el navegador que estoy usando es Opera y la URL HTML es file:///C:/Users/folder/folder/Desktop/folder/example.html , en la barra de direcciones web.
Aquí está el script de Python,
from bs4 import BeautifulSoup import urllib.request import requests # setting URL destination url = "file:///C:/Users/folder/folder/Desktop/folder/example.html" # retrieving HTML payload from the website response = requests.get(url) # using BeautifulSoup to parse the response object soup = BeautifulSoup(response.content, "html.parser") # finding Post images in the soup images = soup.find_all("png", attrs={"alt":"Post image"}) # downloading images number = 0 for image in images: print(image["src"]) image_src = image["src"] urllib.request.urlretrieve(image_src, str(number)) number += 1