Estoy tratando de entender cómo puedo obtener 2 grupos capturados con expresiones regulares (JS), de la siguiente cadena:
"Group: i_am_group |SubGroup: i_am_sub_group" Quiero llegar al final: group1: i_am_group y group2: i_am_sub_group
las reglas son-
Extract the first word after "Group: " into group1 Extract the first word after "SubGroup: " into group2 Necesito implementar esas dos reglas con expresiones regulares para poder ejecutarlas con la función match() en javaScript
Estaba tratando de hacer lo siguiente:
(?<=Group:\s)(\w+) ((?<=|SubGroup:\s)(\w*))y el resultado fue:
Gracias por adelantado.
| tiene un significado especial en expresiones regulares, se usa para especificar alternativas. Necesitas escapar de él para que coincida literalmente.
No hay necesidad de usar mirar atrás cuando estás capturando la parte después de eso. El propósito de las búsquedas es mantenerlos fuera de la cadena coincidente, pero si solo está interesado en los grupos de captura, esto es irrelevante.
Esta expresión regular debería funcionar para usted:
Group:\s(\w+) \|SubGroup:\s(\w*)Si por "palabra" está satisfecho con la definición de \w (que es [A-Za-z0-9_] ; más abajo), puede hacerlo así:
const rex = /Group:\s*(\w+).*?SubGroup:\s*(\w+)/; Agregue la bandera i si desea permitir que Group y SubGroup estén en minúsculas.
Que:
Group:\s* - permite espacios en blanco opcionales después(\w+) captura todos los caracteres de "palabra" que siguen a ese.*? - busca algo opcional (el ? es importante para que no sea codicioso)SubGroup:\s* espacio en blanco opcional de nuevo(\w+) captura todos los caracteres de "palabra" después de esoEjemplo en vivo:
const str = "Group: i_am_group |SubGroup: i_am_sub_group"; const rex = /Group:\s*(\w+).*?SubGroup:\s*(\w+)/; console.log(str.match(rex)); Si desea una definición diferente para el carácter de "palabra" que \w , use [something_here]+ en lugar de \w+ , donde dentro de [ y ] enumera los caracteres / rangos de caracteres que desea considerar como caracteres de "palabra".
Por ejemplo, en inglés, generalmente no consideramos _ como parte de una palabra (aunque sus ejemplos lo usan, así que lo dejaré), pero a menudo consideramos que - es parte de una palabra. También permitimos con frecuencia letras prestadas de otros idiomas como é y ñ , por lo que es posible que desee usarlas en la clase de caracteres. Puede ir más allá y (en entornos ES2015+) usar la definición de Unicode de una "letra", que se escribe \p{Letter} (y requiere el indicador u en la expresión):
const rex = /Group:\s*([-\p{Letter}0-9_]+).*?SubGroup:\s*([-\p{Letter}0-9_]+)/u; (El - al principio se trata literalmente, no como un indicador de un rango).
Ejemplo en vivo:
const str = "Group: i_am_group |SubGroup: i_am_sub_group"; const rex = /Group:\s*([-\p{Letter}0-9_]+).*?SubGroup:\s*([-\p{Letter}0-9_]+)/u; console.log(str.match(rex));