Business
Jobs
  • About Us
  • Solutions
    • Job Postings
      Post your job and receive qualified candidates in 48h.
    • Candidate Assessments
      500+ technical and psychological tests, plus anti-fraud.
    • Headhunting
      Tailor-made executive search from start to finish.
    • Payroll + EOR
      Payroll dispersal and EOR across 15+ LATAM countries.
  • Pricing
  • Jobs

0

438
Views
Elimine el formato anidado y duplicado en HTML (por ejemplo, <b>Esto es<strong>innecesario</strong></b>

Estoy analizando artículos que ocasionalmente pueden tener etiquetas de formato duplicadas, lo que resulta en HTML inflado y evita la conversión adecuada, por ejemplo, en Markdown.

Ejemplo:

 <p> This is an article <strong>with <a href="#"><b>nested</b></a> <strong>emphasized words</strong></strong> </p>

El resultado debería ser, por lo tanto:

 <p> This is an article <strong>with <a href="#">nested</a> emphasized words</strong> </p>

(por el bien de mi limpieza, trato bold y strong por igual, incluso si son semánticamente diferentes)

Mi intuición fue configurar una matriz con los duplicados.

 const duplicates = [ ["strong", "b"], ["em", "i"], ];

Y luego encontrar todos los elementos que están en la lista usando

 let searchTags: string[] = []; searchTags.concat(...duplicates); // Search for all formatting tags const result: NodeList = doc.querySelectorAll(searchTags); // ... in each result, check for formatting type, and check for children of the same formatting type

Sin embargo, esto parece una forma tremendamente ineficiente de atravesar el DOM, y tendría que ejecutar querySelectorAll para actualizar NodeList después de cada iteración para garantizar que no se atraviesen los nodos ya eliminados.

Parece que debería haber una manera más fácil de identificar a los descendientes (incluso si están profundamente anidados y no son nodos secundarios directos) de la misma etiqueta y eliminar la etiqueta, pero no puedo entenderlo.

Gracias :-)

about 4 years ago · Juan Pablo Isaza
1 answers
Answer question

0

 const duplicates = [ ["strong", "strong"], ["strong", "b"], ["em", "i"], ]; for(let i =0; i<duplicates.length; i++){ let sel = [duplicates[i].join` `,duplicates[i].reverse().join` `].join`,`; document.querySelectorAll(sel) .forEach(tag=>tag.replaceWith(document.createTextNode(tag.innerText))); } console.log(document.querySelector('p').outerHTML);
 <p> This is an article <strong>with <a href="#"><b>nested</b></a> <strong>emphasized words</strong></strong> </p>

about 4 years ago · Juan Pablo Isaza Report
Answer question
Find remote jobs

Discover the new way to find a job!

Top jobs
Top job categories
Business
Post vacancy Pricing Sales
Legal
Terms and conditions Privacy policy
© 2026 PeakU Inc. All Rights Reserved.
Andres GPT
Show me some job opportunities
There's an error!