Empresas
Empleos
  • Sobre nosotros
  • Soluciones
    • Publicación de vacantes
      Publica tu vacante y recibe candidatos calificados en 48h.
    • Evaluación de candidatos
      500+ pruebas técnicas y psicológicas, más anti-fraude.
    • Headhunting
      Búsqueda ejecutiva a la medida de principio a fin.
    • Nómina + EOR
      Dispersión de nómina y EOR en más de 15 países de LATAM.
  • Precios
  • Empleos

0

198
Vistas
Práctica recomendada al implementar un clúster de trabajo de Flink en Kubernetes con respecto a guardar puntos y actualizar el trabajo

Estoy investigando la implementación de un trabajo de Flink en Kubernetes. Al revisar la documentación, me cuesta encontrar cuáles son las mejores prácticas con respecto a cómo implementar el trabajo específicamente cuando el trabajo tiene que mantener el estado.

Hay dos puntos principales con respecto a este trabajo:

  1. Es un trabajo de transmisión que trata con datos ilimitados (flujo interminable)
  2. Mantiene y usa el estado que debe mantenerse en diferentes versiones del trabajo

Actualmente, estamos ejecutando en Hadoop. Allí es bastante fácil cuando desea implementar una nueva versión del trabajo y mantener el estado. Los pasos son: cancelar el trabajo con el punto de guardado, luego implementar un nuevo trabajo y apuntar a ese punto de guardado.

Kubernetes:

Según las definiciones, parece que para nuestro caso de uso, un Job Cluster es el que mejor se adapta a los requisitos. Solo habrá un trabajo ejecutándose en este clúster.

El problema con la configuración de Kubernetes es que la ubicación del punto de guardado debe agregarse como argumento para la implementación. En el caso de que un pod se desconecte, reiniciará la aplicación con el punto de guardado original en la implementación. Específicamente, esto restablecerá el desplazamiento de Kafka a cada vez que se implementó el trabajo y reprocesará una gran cantidad de datos.

Además de eso, ¿cómo haría para cancelar un trabajo con un punto de guardado cuando se ejecuta en un clúster de trabajo desde algo como ci/cd? ¿Tendría que crear otro módulo de implementación y usar el resto de la API?

¿Cuál es la mejor práctica para implementar un trabajo de Flink con estado en kubernetes y actualizarlo sin perder el estado?

over 4 years ago · Santiago Trujillo
Responde la pregunta
Encuentra empleos remotos

¡Descubre la nueva forma de encontrar empleo!

Top de empleos
Top categorías de empleo
Empresas
Publicar vacante Precios Comercial
Legal
Términos y condiciones Política de privacidad
© 2026 PeakU Inc. All Rights Reserved.
Andres GPT
Recomiéndame algunas ofertas
Necesito ayuda