- Se descapó
- 4 de septiembre de 2026 a las 19:50 UTC
- Autor
- Kamo
- Compromit
- 5cb2e42
Los despliegues sustituyeron a la única cápsula de cada servicio sin nada para atrapar las solicitudes en vuelo. Tres ajustes, aplicados en toda la flota: - preStop duerme 10s antes de que el proceso vea SIGTERM. Kubernetes elimina la cápsula de su EndpointSlice y lo señala al mismo momento, y Traefik sólo se entera de la eliminación por mira, así que por un momento sigue enviando nuevas solicitudes en una cápsula que ya ha comenzado Rechazándolos. Esa brecha es de donde vinieron los 502 en un despliegue de otra manera limpia. - terminaciónGracePeriodSeconds elevada por encima del sueño pre-parada, por lo que el gancho no es en sí mismo SIGKILLed, y en vuelo el trabajo tiene espacio para terminar. Es un techo, no una espera: una vaina ociosa todavía sale en aproximadamente un segundo. - minListoSegundos 15, por lo que una vaina que pasa de la preparación una vez y luego cae sobre no puede retirarse el vaina saludable que reemplazó después de que CI ya haya llamado al rollo bueno. topologíaSpreadConstraints se agregan listos para una segunda réplica; son inertes en uno. Auditoría del grupo en vivo: 63 de 65 despliegues en el grupo de asistencia de .kamoé ejecutaban una sola réplica, 1 de 65 un gancho preStop, y ninguno tenía minReadySeconds. Sólo minReadySeconds aquí. Estratega: Recrear es deliberado y estancia: ambos servicios se unen NATS EXCLUSIVE JetStream consumidores duraderos en PostConstruct sin reinicio, por lo que una cápsula superpuesta Falle SUB-90012 y el consumidor permanece muerto hasta una báscula manual. Un gancho preStop sólo alargar el husto, porque Recrear aumenta ninguna vaina para servir detrás de ella.