¿Alguien puede explicarme cuál es la diferencia de estas dos funciones en postgres y cuándo para usted cuál?
Tengo estos datos en mi tabla y me gustaría calcular la desviación estándar de la frecuencia de muestreo de los viajes:
user_id | trip_id | lat | lon | sampling_rate ---------+--------------------+------------------+------------------+--------------- 126 | 125020080511025052 | 39.9531666666667 | 116.452566666667 | 7 126 | 125020080511025052 | 39.95305 | 116.452683333333 | 16 126 | 125020080511025052 | 39.9530666666667 | 116.452916666667 | 44 126 | 125020080511025052 | 39.9530833333333 | 116.453183333333 | 40 126 | 125020080511025052 | 39.95335 | 116.45365 | 21 126 | 125020080511025052 | 39.9532833333333 | 116.453816666667 | 16 126 | 125020080511025052 | 39.9533166666667 | 116.45405 | 13 126 | 125020080511025052 | 39.9535666666667 | 116.454383333333 | 24 126 | 125020080511025052 | 39.9537166666667 | 116.4546 | 16 126 | 125020080511025052 | 39.9538333333333 | 116.454733333333 | 17Esta es una pregunta de estadísticas en lugar de una pregunta de programación o base de datos.
La respuesta corta es que usa la desviación estándar de la muestra a menos que tenga una razón para usar la desviación estándar de la población y entienda por qué está usando la desviación estándar de la población en su lugar.
El stddev() en Postgreql se asigna a stddev_samp() .
Esta es una lectura larga, pero cubre los conceptos básicos: https://statistics.laerd.com/statistical-guides/measures-of-spread-range-quartiles.php
A medida que aumenta el número de observaciones en su muestra, la desviación estándar de la muestra converge hacia la desviación estándar de la población.