Empresas
Empleos
  • Sobre nosotros
  • Soluciones
    • Publicación de vacantes
      Publica tu vacante y recibe candidatos calificados en 48h.
    • Evaluación de candidatos
      500+ pruebas técnicas y psicológicas, más anti-fraude.
    • Headhunting
      Búsqueda ejecutiva a la medida de principio a fin.
    • Nómina + EOR
      Dispersión de nómina y EOR en más de 15 países de LATAM.
  • Precios
  • Empleos

0

156
Vistas
PHP Simple HTML DOM Parser que devuelve falso en una URL válida

Estoy intentando lo siguiente:

 $url = 'https://www.tripadvisor.es/Hotels-g187514-Madrid-Hotels.html' $ta_html = file_get_html($url); var_dump($ta_html);

devuelve falso, esto funciona y obtiene correctamente el html para:

 $url = 'https://www.tripadvisor.es/Hotels-g294316-Lima_Lima_Region-Hotels.html#ACCOM_OVERVIEW'

Lo primero que pensé fue que tenía una redirección, pero verifiqué los encabezados con curl y estaba 200 ok y parecía lo mismo en ambos casos. ¿Qué puede estar pasando? como se puede solucionar?

Esto parece ser un duplicado de este problema: HTML DOM simple que devuelve falso que tampoco tiene respuesta

about 4 years ago · Santiago Trujillo
3 Respuestas
Responde la pregunta

0

Parece que el analizador HTML DOM está fallando porque el tamaño del archivo HTML es mayor que el tamaño máximo del archivo de la biblioteca. Cuando llama a file_get_html() , realiza una verificación del tamaño del archivo en función de su constante MAX_FILE_SIZE . Entonces, antes de llamar a cualquier método de analizador HTML DOM, aumente el tamaño máximo de archivo utilizado por la biblioteca llamando:

 define('MAX_FILE_SIZE', 1200000); // or larger if needed, default is 600000

Además, como descubrió, puede evitar la verificación del tamaño del archivo al hacer esto

 $html = new simple_html_dom(); $html->load($str);
about 4 years ago · Santiago Trujillo Denunciar

0

Así que encontré una solución para hacer esto:

 $base = $url; $curl = curl_init(); curl_setopt($curl, CURLOPT_SSL_VERIFYPEER, FALSE); curl_setopt($curl, CURLOPT_HEADER, false); curl_setopt($curl, CURLOPT_FOLLOWLOCATION, true); curl_setopt($curl, CURLOPT_URL, $base); curl_setopt($curl, CURLOPT_REFERER, $base); curl_setopt($curl, CURLOPT_RETURNTRANSFER, TRUE); $str = curl_exec($curl); curl_close($curl); $html = new simple_html_dom(); $html->load($str);

A decir verdad, no sé exactamente por qué funciona esto y cuál fue el problema original, y agradecería si alguien pudiera señalarlo.

about 4 years ago · Santiago Trujillo Denunciar

0

Espero que te ayude:

 $base = $url; $curl = curl_init(); curl_setopt($curl, CURLOPT_SSL_VERIFYPEER, FALSE); curl_setopt($curl, CURLOPT_HEADER, false); curl_setopt($curl, CURLOPT_FOLLOWLOCATION, true); curl_setopt($curl, CURLOPT_URL, $base); curl_setopt($curl, CURLOPT_REFERER, $base); curl_setopt($curl, CURLOPT_RETURNTRANSFER, TRUE); $str = curl_exec($curl); curl_close($curl); $html = new simple_html_dom(); $html->load($str);
about 4 years ago · Santiago Trujillo Denunciar
Responde la pregunta
Encuentra empleos remotos

¡Descubre la nueva forma de encontrar empleo!

Top de empleos
Top categorías de empleo
Empresas
Publicar vacante Precios Comercial
Legal
Términos y condiciones Política de privacidad
© 2026 PeakU Inc. All Rights Reserved.
Andres GPT
Recomiéndame algunas ofertas
Necesito ayuda