Necesito procesar un fragmento de texto en una matriz de palabras.
Los delimitadores entre palabras son líneas nuevas, espacios y varios signos de puntuación, y .
El código que escribí pudo manejar otros casos, pero no el caso.
Aviso: necesito manejar todos los casos dentro de la misma expresión regular y no puedo reemplazar
con espacios
Este código no sale mal, solo se ejecuta en Chrome y el resultado no es el valor esperado.
En la matriz de palabras generada,
"break up test the words"es un valor (incorrecto), necesito que sea 5:[break,up,test,the,words](correcto)
mi código:
<!DOCTYPE html><html><head> <script> window.onload = function(){ var text = document.getElementById('text').textContent // of below regex doesn't work var word_array = text.split(/[ \t\n\r.?,"';:!(){}<>\/]| /) console.log(text) console.log(word_array) } </script> </head><body> <div id="text">this is text,break up test the words!ok</div> </body></html>El problema es que la expresión regular ve   como esos caracteres exactos. Desea usar '\ xa0' en su lugar.