Empresas
Empleos
  • Sobre nosotros
  • Soluciones
    • Publicación de vacantes
      Publica tu vacante y recibe candidatos calificados en 48h.
    • Evaluación de candidatos
      500+ pruebas técnicas y psicológicas, más anti-fraude.
    • Headhunting
      Búsqueda ejecutiva a la medida de principio a fin.
    • Nómina + EOR
      Dispersión de nómina y EOR en más de 15 países de LATAM.
  • Precios
  • Empleos

0

322
Vistas
¿Cómo restaurar los datos de corrimiento al rojo que no están presentes en una instantánea anterior?

Actualmente tenemos una copia de seguridad manual automatizada de los datos de corrimiento al rojo cada 1 hora. Suponiendo que un clúster se cae y los datos se restauran desde una instantánea, también quiero restaurar los datos que no están presentes en la instantánea.

PD: los datos completos están presentes en s3 antes de pasar al corrimiento al rojo.

¿Cómo puedo abordar este problema? De modo que obtenga los datos restantes de mi s3 para redshift después de la restauración de la instantánea.

over 4 years ago · Santiago Trujillo
1 Respuestas
Responde la pregunta

0

Necesitaría tener algún indicador tanto en Redshift como en S3 para saber qué datos se cargan.

Por ejemplo, si sus datos en S3 están particionados por Año, Mes, Día y Hora así:

 s3://my_bucket/my_prefix/year=2017/month=3/day=11/hour=10/my_file_parts.pt001.gz

Luego, desea tener columnas de año, mes, día y hora en sus tablas Redshift para que pueda encontrar la partición máxima que se cargó.

 SELECT MAX(year||month||day||hour) FROM my_table

Luego puede volver a cargar cualquier partición que no esté presente actualmente en Redshift.

over 4 years ago · Santiago Trujillo Denunciar
Responde la pregunta
Encuentra empleos remotos

¡Descubre la nueva forma de encontrar empleo!

Top de empleos
Top categorías de empleo
Empresas
Publicar vacante Precios Comercial
Legal
Términos y condiciones Política de privacidad
© 2026 PeakU Inc. All Rights Reserved.
Andres GPT
Recomiéndame algunas ofertas
Necesito ayuda