Empresas
Empregos
  • Sobre nós
  • Soluções
    • Publicação de vagas
      Publique sua vaga e receba candidatos qualificados em 48h.
    • Avaliações de candidatos
      Mais de 500 testes técnicos e psicológicos, mais anti-fraude.
    • Headhunting
      Busca executiva personalizada do início ao fim.
    • Folha de Pagamento + EOR
      Dispersão de folha e EOR em mais de 15 países da LATAM.
  • Preços
  • Empregos

0

82
Visualizações
Extraer información de XML usando Javasript

Tengo un archivo de Word guardado como un archivo XML y quería extraer toda la información entre las etiquetas <w:t>. Este es el fragmento de código que estoy usando.

 //var parser = new DOMParser(); const fs = require('fs'); const { connect } = require('http2'); var format = require('xml-formatter'); try { // read contents of the file const data = fs.readFileSync('untitled.xml', 'UTF-8'); //var d = format(data); // split the contents by new line const lines = data.split(/\r?\n/); // print all lines lines.forEach((line) => { if(/<w:t>.*:.*<\/w:t>/.test(line)){ console.log(line); // var match = line.match(/<w:t>Comment:.*<\/w:t>/g); // console.log(match); // console.log('ASDRWSGQERGEAHGERAGERgfew'); } }); } catch (err) { console.error(err); }

El problema es que como la estructura de árbol del XML no se conserva mientras lo leo, la salida tiende a tener muchas líneas innecesarias. Cuando copio y pego el mismo archivo desde un navegador y lo guardo como XML, el resultado es limpio. ¿Hay otra forma de leer el XML para obtener una salida limpia? salida de basura actual

about 4 years ago · Juan Pablo Isaza
Responde à pergunta
Encontrar trabalhos remotos

Descubra a nova forma de encontrar um emprego!

melhores empregos
Principais categorias de trabalho
Empresas
Postar vaga Preços Comercial
Jurídico
Termos e Condições Política de privacidade
© 2026 PeakU Inc. All Rights Reserved.
Andres GPT
Recomende algumas ofertas para mim
Preciso de ajuda