Empresas
Empleos
  • Sobre nosotros
  • Soluciones
    • Publicación de vacantes
      Publica tu vacante y recibe candidatos calificados en 48h.
    • Evaluación de candidatos
      500+ pruebas técnicas y psicológicas, más anti-fraude.
    • Headhunting
      Búsqueda ejecutiva a la medida de principio a fin.
    • Nómina + EOR
      Dispersión de nómina y EOR en más de 15 países de LATAM.
  • Precios
  • Empleos

0

259
Vistas
Error al raspar el sitio web después de crear su archivo .exe

Estoy tratando de desechar el sitio web usando scrapy. Escribo la lógica en python y funciona correctamente en la terminal de python. Pero cuando hago el archivo .exe y ejecuto el archivo .exe. Muestra el error. He intentado obtener la respuesta pero no la obtuve. ¿Alguien puede ayudarme por favor? el error es:

Este es el error que recibo después de ejecutar el archivo .exe

 import scrapy class BBCUrduSpider(scrapy.Spider): name = 'bbcurdu' url = "" fileName = 'dataFileForAll.csv' index = 0 def start_requests(self): yield scrapy.Request(url=self.url) # Creating code for the 100 news for each category. # To BBC Main Page. def parse(self, response): links = response.xpath("//ul[@class='bbc-11krpir e1lim4kn4']/li[position() > 1 and position() < 8]/a") for link in links: self.index = 0 href = response.urljoin(link.xpath(".//@href").get()) # Links of all the categories. yield response.follow(url=href, callback=self.getIntoLinks) # To Every Individual Category. def getIntoLinks(self, response): ctgry = response.xpath("//h1[@class='topic-title gel-trafalgar-bold gs-u-pt-alt+ gs-u-pb+']//text()").get() # ctgry = pakistan linkks = response.xpath("//article/header/div/h3/a") for linkk in linkks: href = response.urljoin(linkk.xpath(".//@href").get()) yield response.follow(url=href, callback=self.getTheFullDetail, meta={'Label':ctgry}) nextLink = response.urljoin(response.xpath("//a[@class='lx-pagination__btn gs-u-mr+ qa-pagination-next-page lx-pagination__btn--rtl lx-pagination__btn--active']/@href").get()) last6characters = nextLink[(len(nextLink) - 6): len(nextLink)] if nextLink and last6characters != "age/12": yield scrapy.Request(url=nextLink, callback=self.getIntoLinks) # Third function to get the headline and detail of the news. def getTheFullDetail(self, response): ctgry = response.request.meta['Label'] heading = response.xpath("//h1[@id='content']//text()").get() fullnewsLinks = response.xpath("//div[@class='bbc-4wucq3 e57qer20']/p[@class='bbc-1sy09mr e1cc2ql70']") fullnews = '' for fullnewslink in fullnewsLinks: if fullnewslink.xpath(".//b"): fullnews += fullnewslink.xpath(".//b/text()").get() else: fullnews += fullnewslink.xpath(".//text()").get() yield { 'Category: ':ctgry, 'Heading: ':heading, 'Full News: ':fullnews }
about 4 years ago · Juan Pablo Isaza
Responde la pregunta
Encuentra empleos remotos

¡Descubre la nueva forma de encontrar empleo!

Top de empleos
Top categorías de empleo
Empresas
Publicar vacante Precios Comercial
Legal
Términos y condiciones Política de privacidad
© 2026 PeakU Inc. All Rights Reserved.
Andres GPT
Recomiéndame algunas ofertas
Necesito ayuda