tengo las siguientes tablas
En la tabla PRODUCTO, 'puntuación' es una columna clave/valor donde la clave es un idCustomer y el valor es una clasificación entera.
La consulta para contar los pedidos que contienen un producto en el que el cliente ha dado una buena calificación se ve así:
select count(distinct o.idOrder) from order o, orderline l, product p where o.idorder = l.idorder and l.idproduct = p.idproduct and (p.rating->(o.idcust::varchar)::int) > 4;El plan de consulta parece correcto, pero esta consulta lleva una eternidad. Así que probé una consulta diferente, donde exploté todos los registros en hstore:
select count(distinct o.idOrder) from order o, orderline l, (select idproduct, skeys(p.rating) idcustomer, svals(p.rating) intrating from product) as p where o.idorder = l.idorder and l.idproduct = p.idproduct and o.idcustomer = p.idcustomer and p.intrating > 4;Esta consulta toma solo unos segundos. ¿Cómo es esto posible? Supuse que explotar todos los valores de un hstore sería bastante ineficiente, pero parece ser lo contrario. ¿Es posible que no esté escribiendo correctamente la primera consulta?
Sospecho que es porque en la primera consulta que estás haciendo:
p.rating->(o.idcust::varchar)::int
una fila a la vez a medida que la consulta itera sobre el resto de las operaciones, mientras que en la segunda consulta los valores de hstore se expanden en una sola consulta. Si desea obtener más información, utilice EXPLAIN ANALYZE: