Tengo una colección de mongo. Mi colección se puede considerar así:
{ "kwId" : "123445", "p1": "15" "p2": "25", "date": "2017-01-28" } { "kwId" : "123446", "p1": "25" "p2": "30", "date": "2017-01-28" } { "kwId" : "123445", "p1": "35" "p2": "40", "date": "2017-01-27" } { "kwId" : "123446", "p1": "30" "p2": "50", "date": "2017-01-27" }Para cada fecha, tengo alrededor de 44k documentos. Digamos que quiero encontrar diferencias de valores p1 y p2 para documentos que tienen el mismo kwId pero diferente fecha, como 2017-01-28 y 2017-01-27. Resultado de ejemplo:
{ "kwId" : "123445", "p1": "20" "p2": "15", } { "kwId" : "123446", "p1": "5" "p2": "20", }¿Cuál es la forma más eficiente de hacerlo? Estoy usando PHP y lo que he intentado es recuperar todos los documentos para fechas determinadas y calcular la diferencia en PHP. Fue bastante lento.
Me di cuenta que la forma correcta es hacer los cálculos con PHP. Primero, he cambiado la estructura. Hice kwId y feché el id . Hay 2 razones para eso.
Estoy consultando los documentos tanto por kwId como por fecha. Por lo que deben indexarse para agilizar el proceso.
{ "id": { "kwId": 123445, "fecha": "2017-01-28" }, "p1": "15", "p2": "25" }
En mi pregunta, dije: "Lo intenté, recuperé todos los documentos para fechas determinadas y calculé la diferencia en PHP. Fue bastante lento". El proceso tardó alrededor de 50 minutos en completarse. Después de un pequeño cambio en la estructura del documento como mencioné anteriormente, y usando la búsqueda binaria en lugar de la función de búsqueda predeterminada de php, ahora tengo que esperar solo unos milisegundos.