Al probar mi aplicación Django, me encontré con un problema de rendimiento con una consulta en particular cuando se usaba un filtro () en particular. El problema se resolvió, pero no entiendo por qué.
Estoy filtrando un QuerySet basado en 3 criterios. Al incluirlos todos a la vez, obtengo el número esperado de resultados. Al mover una de las cláusulas a su propia llamada filter(), el QuerySet resultante es mucho, mucho más grande de lo que debería ser y está lleno de entradas aparentemente duplicadas.
Vea a continuación una ilustración de esto. Mover la cláusula result__is_false=False a su propio filter() provoca una gran expansión en el QuerySet resultante.
>>> Finding.objects.filter(project=1, result__scan_session__is_enabled=True,\ result__is_false=False).count() 3566 >>> Finding.objects.filter(project=1, result__scan_session__is_enabled=True)\ .filter(result__is_false=False).count() 10050380El problema era que necesitaba aplicar condicionalmente el filtro en cuestión, no siempre. Resolví el problema convirtiendo la rutina filter() en una rutina include() como esta:
>>> Finding.objects.filter(project=1, result__scan_session__is_enabled=True)\ .exclude(result__is_false=True).count() 3566¡Eso parecía haber funcionado!
Si bien estoy feliz de que esto haya funcionado, no entiendo dos cosas:
1) ¿Por qué las publicaciones que explican el filtro () y excluir () parecen sugerir que pueden tratarse como iguales pero opuestos, cuando se basa en el ejemplo anterior, ese no siempre es el caso?
2) Por qué mover la cláusula result__is_false=False a su propio filter() causó el gran salto en los resultados en primer lugar.
¿Alguien tiene alguna idea de alguno de estos?
Ambos parecen el resultado esperado de cómo funcionan las llamadas de filter sucesivas en relaciones multivaluadas. Los documentos explican en detalle, con ejemplos:
Todo lo que se encuentra dentro de una sola llamada filter() se aplica simultáneamente para filtrar elementos que cumplan con todos esos requisitos. Las sucesivas llamadas a filter() restringen aún más el conjunto de objetos, pero para las relaciones de varios valores, se aplican a cualquier objeto vinculado al modelo principal, no necesariamente a los objetos que fueron seleccionados por una llamada anterior a filter().
Entonces, su segunda llamada de filter devuelve cualquier Finding donde haya al menos un resultado no falso. La llamada de exclude devuelve cualquier resultado en el que no haya al menos un resultado falso. Son intercambiables cuando se consultan campos que no aceptan valores NULL en valores únicos, pero no en todos los casos.