Empresas
Empleos
  • Sobre nosotros
  • Soluciones
    • Publicación de vacantes
      Publica tu vacante y recibe candidatos calificados en 48h.
    • Evaluación de candidatos
      500+ pruebas técnicas y psicológicas, más anti-fraude.
    • Headhunting
      Búsqueda ejecutiva a la medida de principio a fin.
    • Nómina + EOR
      Dispersión de nómina y EOR en más de 15 países de LATAM.
  • Precios
  • Empleos

0

301
Vistas
Script de Python como cron en depósitos de AWS S3

Tengo un script de python que copia archivos de un depósito S3 a otro depósito S3. Este script debe ejecutarse todos los domingos a una hora específica. Estaba leyendo algunos artículos y respuestas, así que traté de usar eventos AWS lambda + Cloudwatch. Estos archivos se ejecutan durante un mínimo de 30 minutos. ¿Seguiría siendo bueno con Lambda, ya que Lambda solo puede funcionar como máximo 15 minutos? o hay otra manera? Puedo crear un cuadro EC2 y ejecutarlo como Cron, pero eso sería costoso. ¿O alguna otra forma estándar?

over 4 years ago · Santiago Trujillo
3 Respuestas
Responde la pregunta

0

Si se supone que los dos depósitos deben permanecer sincronizados, es decir, todos los archivos del depósito n.º 1 deben sincronizarse finalmente con el depósito n.º 2, entonces hay varias opciones de replicación en S3 .

De lo contrario, consulte Operaciones por lotes de S3 . Puede derivar la lista de archivos que necesita copiar del Inventario de S3 , lo que le brindará un contexto adicional sobre los archivos, como la fecha/hora de carga, el tamaño, la clase de almacenamiento, etc.

over 4 years ago · Santiago Trujillo Denunciar

0

La forma más apropiada sería usar aws glue python shell job , ya que está bajo el paraguas sin servidor y se le cobrará a medida que avanza.

Entonces, de esta manera, solo se le cobrará por el tiempo que se ejecuta su código. Además, no necesita administrar el EC2 para esto. Esto es como una lambda extendida.

over 4 years ago · Santiago Trujillo Denunciar

0

Desafortunadamente, el tiempo de ejecución de 15 minutos de lambda es una parada difícil, por lo que no es adecuado para este caso de uso como una gran explosión.

Puede usar varias llamadas lambda para pasar por los objetos uno a la vez y moverlos. Sin embargo, necesitaría una tabla de DynamoDB (o algo similar) para realizar un seguimiento de lo que se ha movido y lo que no.

Otro par de opciones serían:

  • S3 Replication que mantendrá un depósito sincronizado con el otro.
  • Una operación por lotes de S3

¿O si sus archivos de datos? siempre puedes usar pegamento AWS.

over 4 years ago · Santiago Trujillo Denunciar
Responde la pregunta
Encuentra empleos remotos

¡Descubre la nueva forma de encontrar empleo!

Top de empleos
Top categorías de empleo
Empresas
Publicar vacante Precios Comercial
Legal
Términos y condiciones Política de privacidad
© 2026 PeakU Inc. All Rights Reserved.
Andres GPT
Recomiéndame algunas ofertas
Necesito ayuda