Estoy tratando de raspar web usando Java y Selenium, pero una parte de lo que necesito para raspar web requiere que acceda a un elemento DOM oculto. Estoy usando el ejecutor de Javascript para acceder a él y estoy ingresando el fragmento de código querySelector necesario para recuperar lo que estoy buscando, pero recibo el error "No se pueden leer las propiedades de nulo (leyendo 'ShadowRoot')". ¿Alguien está familiarizado con esto y cómo solucionarlo?
Aquí está mi fragmento de código:
String pagePdfUrl = (String) js.executeScript("document.querySelector('pdf-viewer').shadowRoot.getElementById('content').querySelector('embed').getAttribute('original-url')");js es la variable JavascriptExectuor.
¡Gracias!
Al usar querySelector() para leer un ShadowRoot este mensaje de error...
Cannot read properties of null...implica cualquiera de las siguientes circunstancias:
En el caso del primer y segundo escenario, no podrá acceder a ShadowRoot . Donde, como en el tercer caso, debe esperar un momento, por ejemplo time.sleep(3) antes de intentar acceder a ShadowRoot y sus elementos.
En Selenium 4.0, para las versiones de Chromium 96+, puede usar el método getShadowRoot() y evitar JavaScript por completo.
Un ejemplo de trabajo:
driver.get("http://watir.com/examples/shadow_dom.html"); WebElement shadowHost = driver.findElement(By.cssSelector("#shadow_host")); SearchContext shadowRoot = shadowHost.getShadowRoot(); WebElement shadowContent = shadowRoot.findElement(By.cssSelector("#shadow_content"));Fuente: https://titusfortner.com/2021/11/22/shadow-dom-selenium.html