Tengo problemas con mi clúster de Kubernetes. Tengo un servicio con un deployment asociado. Tengo varias réplicas de los pods en esta implementación en funcionamiento y 2 contenedores para cada implementación.
Estoy usando una estrategia de Rolling Update continua para volver a implementar, con parámetros maxSurge : 1 y maxUnavailable: 0 . Cuando cambio una implementación, los pods cambian correctamente, agregan un nuevo pod y luego eliminan uno anterior hasta que se cambia toda la implementación.
Sin embargo, en el cambio del primer pod de viejo a nuevo, tengo una pequeña interrupción. Esto no sucede cuando estoy cambiando los otros pods, es decir, cuando hay al menos un pod nuevo funcionando.
¿Qué puedo hacer para solucionar este problema? Tengo un livenessProbe y un readinessProbe , pero aún parece que el nuevo pod no está listo para recibir tráfico cuando se inicia, aunque el readinessProbe funciona correctamente. He leído que en algunas aplicaciones, el pod no se cierra con un SIGTERM como espera Kubernetes y, por lo tanto, el pod se cierra abruptamente. Me pregunto si este es el problema, pero no puedo estar seguro. ¿Cuál sería la forma correcta de manejar esto en el preStop ? ¿Hay algo que me podría estar perdiendo?