Actualmente estoy transmitiendo datos de IOT a mi MongoDB que se ejecuta en un contenedor Docker (alojado en AWS). Por día recibo un par de miles de puntos de datos.
Usaré estos datos recopilados para un análisis de datos intensivo y ML que se ejecutará día a día.
Entonces, ¿es así como normalmente se almacenan los grandes datos? ¿Cuáles son los estándares industriales y las mejores prácticas?
Depende de muchos factores, por ejemplo, el tipo de datos que uno está analizando, cuántos datos tiene y qué tan rápido los necesita.
Las bases de datos que comúnmente se utilizan en la industria para almacenar Big Data son:
Espero eso ayude.