Solo he podido obtener nodos de resultados de mi DOM con XPath, lo que parece incorrecto.
Estoy intentando mostrar un fragmento de un documento XML (TEI/XML) en mi página HTML. Tengo la URL de un documento XML y un selector XPath del fragmento. Pensé que podría fetch() el documento y extraer la pieza que quería así:
// Real values, for one case, // t.source = "https://centerfordigitalhumanities.github.io/Dunbar-books/The-Complete-Poems-TEI.xml" // t.selector.value = "//div[@type='poem'][8]" const sampleSource = await fetch(t.source) .then(res => res.text()) .then(docStr => (new DOMParser()).parseFromString(docStr, "application/xml")) const poemText = sampleSource.evaluate(t.selector?.value, sampleSource, null, XPathResult.ORDERED_NODE_SNAPSHOT_TYPE, null) textSample.innerHTML = poemText.snapshotItem(0).innerHTML Probando varias formas diferentes (cambiando contextNode , usando XPathSelector.evaluate() en lugar de XMLDoc.evaluate() , y cambiando XPathResult ) el resultado siempre estaba vacío.
Frustrado, probé selectores cada vez más simples y descubrí que evaluate() solo estaba atravesando mi document HTML actual a pesar de no hacer referencia a él.
"Funciona" para volcar el documento XML en un elemento oculto en la página.
const sampleSource = await fetch(t.source) .then(res => res.text()) .then(docStr => hiddenElem.innerHTML = docStr) const poemText = document.evaluate(t.selector?.value, hiddenElem, null, XPathResult.ORDERED_NODE_SNAPSHOT_TYPE, null) textSample.innerHTML = poemText.snapshotItem(0).innerHTMLevaluate() solo atraviesa el document ?Bueno, es un documento TEI, por lo que sus elementos están en el espacio de nombres http://www.tei-c.org/ns/1.0 , no espere usar XPath 1 contra un documento XML DOM y un selector como div para seleccionar elementos en cualquier espacio de nombres, selecciona exactamente elementos div en ningún espacio de nombres. Para seleccionar elementos en un espacio de nombres con XPath 1.0, debe usar el tercer argumento de evaluate y vincular un prefijo que puede elegir (como tei ) a ese espacio de nombres y usar, por ejemplo, //tei:div[@type='poem'][8] :
<script type=module> const sampleSource = await fetch('https://centerfordigitalhumanities.github.io/Dunbar-books/The-Complete-Poems-TEI.xml') .then(res => res.text()) .then(docStr => (new DOMParser()).parseFromString(docStr, "application/xml")); const poemText = sampleSource.evaluate(`//tei:div[@type='poem'][8]`, sampleSource, prefix => prefix === 'tei' ? 'http://www.tei-c.org/ns/1.0' : null, XPathResult.ORDERED_NODE_SNAPSHOT_TYPE, null); console.log(poemText.snapshotItem(0).textContent); </script> Con XPath 2 o 3, como admite Saxon-JS 2, por ejemplo, puede vincular un espacio de nombres de elemento predeterminado y usar un nombre no calificado como div para seleccionar elementos en ese espacio de nombres.
<script src=https://www.saxonica.com/saxon-js/documentation/SaxonJS/SaxonJS2.rt.js></script> <script type=module> const sampleSource = await SaxonJS.getResource({ location : 'https://centerfordigitalhumanities.github.io/Dunbar-books/The-Complete-Poems-TEI.xml', type : 'xml' }); const poemText = SaxonJS.XPath.evaluate(`//div[@type='poem'][8]`, sampleSource, { xpathDefaultNamespace : 'http://www.tei-c.org/ns/1.0' }); console.log(poemText.textContent); </script>No hay forma en XPath 1.0, a menos que el entorno DOM le permita crear un espacio de nombres sin DOM (como Java con un DocumentBuilder que no reconoce espacios de nombres). Pero dentro de un navegador ese no es el caso, que yo sepa.