Tengo algo de HTML como una cadena
var str= "<p><br/></p>"¿Cómo elimino las etiquetas p de esta cadena usando JS? esto es lo que he intentado hasta ahora:
str.replace(/<p[^>]*>(?:\s| )*<\/p>/, "") // o/p: <p><br></p>' str.replace("/<p[^>]*><\\/p[^>]*>/", "")// o/p: <p><br></p>' str.replace(/<p><br><\/p>/g, "")// o/p: <p><br></p>' todos me devuelven el mismo str que el anterior, el o/p esperado es: str debería ser "" ¿qué estoy haciendo mal aquí?
Gracias
Probablemente no debería usar RegExp para analizar HTML; no es particularmente útil con el marcado de estilo (X) HTML, ya que hay demasiados casos extremos.
En su lugar, analice el HTML como lo haría con un elemento en el DOM, luego compare el valor trim() med innerText de cada <p> con una cadena en blanco y elimine los que sean iguales:
var str = "<p><br/></p><p>This paragraph has text</p>" var ele = document.createElement('body'); ele.innerHTML = str; [...ele.querySelectorAll('p')].forEach(para => { if (para.innerText.trim() === "") ele.removeChild(para); }); console.log(ele.innerHTML);Debería poder utilizar la siguiente expresión: <p[^>]*>( |\s+|<br\s*\/?>)*<\/p>
La expresión anterior examina las expresiones encerradas entre <p>...</p> y las compara con , espacios en blanco ( \s+ ) y <br> (y / variaciones).
Creo que estuviste mayormente allí con /<p[^>]*>(?:\s| )*<\/p>/ , pero solo necesitabas eliminar ?: (no estoy seguro de lo que estabas tratando de hacer aquí), y agregando un caso adicional para <br> .
const str = ` <p><br></p> <p><br/></p> <p><br /></p> <p> <br/> </p> <p> </p> <p> </p> <p><br/> </p> <p> <br> </p><!-- multiline --> <p><br/> don't replace me</p> <p>don't replace me</p> `; const exp = /<p[^>]*>( |\s+|<br\s*\/?>)*<\/p>/g; console.log(str.replace(exp, ''));