- Shiked
- 5 Ağustos 2026 00:11 UTC
- Yazar
- Kamo
- Commit
- 00ad3ef
Kök nedeni: liveness probe "tcpSocket: port 10000", ama Scylla'nın REST API'si Api address 127.0.0.1 (belirli) bir tcpSocket Pro, POD'yi sorgularken IP. konteynerin içinde doğrulandı - /proc/net/tcp gösteriyor :10000 Sadece sadece dinliyor 0100007F (127.0.0.1), ancak 9042/9180/7000/19042 pod IP üzerindedir; ve "curl ************************ Aynı istekle 200 geri dönerken pod IP'ye reddedilir (kullanış 7), ki bu tam olarak kubelet'in bildirdiği şeydir: "Liveness probe başarısız oldu: tcp 10.42.0.47:10000: bağlantı reddedildi". Bu yüzden son her girişimde başarısız oldu ve kubelet her konteyneri öldürdü döngüsü: ilkDelayİkincileri 900 + başarısızlıkThreshold 80 x periodİkinci 30 = 3300s, 55m14'lerin ve 920'in yeniden başlamasıyla ilgili gözlemleri eşleştirmek / 35 gün ( 54.7 dakika başına biri). Her öldürme ilk Durun'u koştu, bu yüzden 0 / 4 "Completed" ve bir kazadan ziyade temiz bir kapatma gibi görünüyordu. Daha önceki 900s/80 değerleri, yorum iddia ettiği gibi soğuk başlangıç ayar değildi - Bunu maskeliyorlardı. Sadece öldürme döngüsünü genişlettiler; önceki 60s / 6 6 Değerler her ~4 dakika (~360/gün) bir yeniden inşa etti. Fix: Aslında dinlediği API'yi, 127.0.0.1'e karşı exec ile ve anlamlı bir eşi geri yükleme (6 x 30s = 3 min). startupProbe zaten kapılar CQL'ye kadar canlılık, bu yüzden ilkDelayİkinciler gereksizdir. Deliberately not ayar -api-address 0.0.0.0, bu, istenmeyen yönetici REST'yi ortaya çıkaracak. API to the pod network.