- Expédié
- 5 août 2026 à 00:11 UTC
- Auteur
- Kamo
- Commite
- 00ad3ef
Cause de racine: la sonde de vie était la prise de vue: port de 10 000, mais l'API REST de Scylla se lie à api-address 127.0.0.1 (son défaut) tandis qu'une sonde tcpSocket compose la POD IP. Vérifié de l'intérieur du conteneur /proc/net/tcp montre :10000 écoute seulement le 0100007F (127.0.0.1), tandis que le 9042/9180/7000/19042 est sur la nacelle IP; et - Rends 200 alors que la même demande à la pod IP est refusée (arrêt 7 de la bouée), qui est exactement ce que kubelet a rapporté: "Sonde de vie défaillante: cadran tcp 10.42.0.47:10000: connecter: connexion refusée". Donc la sonde a échoué à chaque tentative et le kubelet a tué le conteneur tous les cycle: InitialDelaySeconds 900 - échecSeuil 80 x périodeDeuxièmes et 3300s, correspondant à la période de redémarrage observée de 55 m14 et 920 redémarrages / 35 jours (Queltre par 54,7 min). Chaque tueur a exécuté le préStop "nodetool drain", donc il est sorti 0 / "Achevé" et ressemblait à un arrêt net plutôt qu'à un accident. Les valeurs antérieures de 900 s/80 n'étaient pas des réglages à froid comme le commentaire l'indiquait Ils masquaient cela. Ils n'ont étiré que le cycle de destruction; les années 60 précédentes/6 valeurs ont produit un redémarrage tous les 4 min (360 dollars/jour). Fixer: sonder l'API où elle écoute réellement, via exec contre 127.0.0.1, et rétablir un seuil significatif (6 x 30s x 3 min). startupProbe déjà porte la vieil de vie jusqu'à ce que CQL soit à la hausse, donc initialDelaySeconds n'est pas nécessaire. Délibérément non réglage -api-adresse 0.0.0.0, qui exposerait l'administration non authentifiée REST API au réseau de la nacelle.