- Se descapó
- 5 de agosto de 2026 a las 0:11 UTC
- Autor
- Kamo
- Compromit
- 00ad3ef
Causa raíz: la sonda de vida fue "tcpSocket": puerto 10000", pero Scylla's REST API se une a la dirección 127.0.0.1 (su defecto) mientras que una sonda de tocpSocket marca el POD IP. Verificado desde el interior del contenedor . /proc/net/tcp muestra :10000 escuchas solamente al 0100007F (127.0.0.1), mientras que el 9042/9180/7000/19042 se encuentra en la cápsula IP; y Ocurl ************* devuelve 200 mientras que la misma petición a la IP de la vaina se rechaza (salida de curl 7), que es exactamente lo que kubelet informó: "La sonda de en vivo fracasó: dial tcp 10.42.0.47:10000: connect: conexión rechazada". Así que la sonda fracasó en cada intento y el kubelet mató al contenedor cada ciclo: inicialDelaySeconds 900 - failureThreshold 80 x períodoSegundos 30 = 3300s, correspondientes al período de reinicio observado de 55m14s y 920 reinicios / 35 días (uno por 54,7 min). Cada asesinato corrió el drenaje preStop denodetool, por lo que salió 0 / "Completado" y parecía un cierre limpio en lugar de un choque. Los valores anteriores de 900s/80 no fueron sintonía en frío como el comentario reclamó estaban enmascarando esto. Sólo estiraron el ciclo de la muerte; los anteriores 60/6 valores producidos un reinicio cada 4 min (360/día). Arreglar: sonda la API donde realmente escucha, vía ejecutiva contra 127.0.0.1, y restaurar un umbral significativo (6 x 30s = 3 min). startupProbe ya puertas vida hasta que CQL haya subido, por lo que inicialDelaySeconds es innecesario. Deliberadamente no configuración --api-address 0.0.0.0, que expondría el administrador no autenticado REST API a la red de vainas.