Tengo una larga lista de roles obtenidos de un rango de hojas almacenado como cadenas en una matriz, para dar un ejemplo, la matriz se ve así:
arr1 = ["football manager","hockey coach", "fb player","fb coach","footballer"];y tengo otra matriz en la que tengo una pequeña lista de etiquetas
arr2 = ["football","fb", "footballer","hockey","rugby"];Estoy tratando de hacer coincidir los roles de la primera matriz con las etiquetas de la segunda.
He estado tratando de hacer esto recorriendo y obteniendo el índice de la fila coincidente:
for(let i in arr1){ arr2.findIndex(s => s.indexOf(arr1[i]) >= 0); }Pero esto solo funciona para "futbolista", ya que es una coincidencia exacta, también necesito que se clasifiquen todas las coincidencias parciales.
Use la siguiente función para encontrar índices de etiquetas (de la matriz arr2 ) que coincidan con los valores de arr1 .
Siga los comentarios del código para obtener una explicación detallada.
function matchTagIndexes() { // TODO replace with your values arr1 = ["football manager","hockey coach", "fb player","fb coach","footballer"]; // TODO replace with your tags arr2 = ["football","fb", "footballer","hockey","rugby"]; // for all tags create regex objects // regex searches for any match that have `tag` surrounded with word (\b) boundaries // see https://developer.mozilla.org/en-US/docs/Web/JavaScript/Guide/Regular_Expressions/Cheatsheet#boundary-type_assertions const arr2Regexes = arr2.map(tag => new RegExp(`\\b${tag}\\b`, 'i')); // loop arr1 values as val arr1.map(val => // for each arr2 regex match val arr2Regexes.forEach((regex, i) => // if it is matched, log value from arr1 array, matched tag name and tag's index in arr2 array val.match(regex) && console.log(`"${val}" matches tag "${arr2[i]}" which has index ${i}`) ) ); }Resultado:
| tiempo | estado | mensaje |
|---|---|---|
| 20:46:35 | Aviso | Ejecución iniciada |
| 20:46:35 | Información | "gerente de fútbol" coincide con la etiqueta "fútbol" que tiene el índice 0 |
| 20:46:35 | Información | "entrenador de hockey" coincide con la etiqueta "hockey" que tiene el índice 3 |
| 20:46:35 | Información | "fb player" coincide con la etiqueta "fb" que tiene el índice 1 |
| 20:46:35 | Información | "fb coach" coincide con la etiqueta "fb" que tiene el índice 1 |
| 20:46:35 | Información | "futbolista" coincide con la etiqueta "futbolista" que tiene el índice 2 |
| 20:46:36 | Aviso | Ejecución completada |
Referencia:
Sospecho que podría haber varias etiquetas para algunos de los textos ( arr1 ). Aquí está la solución para obtener la matriz de etiquetas (índices) para cada uno de los textos:
var texts = ['football manager','hockey coach', 'fb player','fb coach','footballer', 'none']; var tags = ['football','fb', 'footballer','hockey','rugby', 'coach']; // get all tags for all the texts var list = []; for (let tag of tags) { var mask = RegExp('\\b' + tag + '\\b', 'i'); for (let text of texts) { if (text.match(mask)) list.push( {'text': text, 'tag': tag, 'tag_index': tags.indexOf(tag)} ); } } console.log(list); // group tags for the same texts var text_and_tags = {}; for (let element of list) { try { text_and_tags[element.text].push(element.tag_index) } catch(e) { text_and_tags[element.text] = [element.tag_index] } } console.log(text_and_tags); Obtendrá el objeto text_and_tags de la siguiente manera:
{ 'football manager': [ 0 ], 'fb player': [ 1 ], 'fb coach': [ 1, 5 ], 'footballer': [ 2 ], 'hockey coach': [ 3, 5 ] }