Liveness probe asla geçemedi - 920 yeniden başlatma nedeni 35 gün içinde

FixKlusterServices
Shiked
5 Ağustos 2026 00:11 UTC
Yazar
Kamo
Commit
00ad3ef

Kök nedeni: liveness probe "tcpSocket: port 10000", ama Scylla'nın REST API'si Api address 127.0.0.1 (belirli) bir tcpSocket Pro, POD'yi sorgularken IP. konteynerin içinde doğrulandı - /proc/net/tcp gösteriyor :10000 Sadece sadece dinliyor 0100007F (127.0.0.1), ancak 9042/9180/7000/19042 pod IP üzerindedir; ve "curl ************************ Aynı istekle 200 geri dönerken pod IP'ye reddedilir (kullanış 7), ki bu tam olarak kubelet'in bildirdiği şeydir: "Liveness probe başarısız oldu: tcp 10.42.0.47:10000: bağlantı reddedildi". Bu yüzden son her girişimde başarısız oldu ve kubelet her konteyneri öldürdü döngüsü: ilkDelayİkincileri 900 + başarısızlıkThreshold 80 x periodİkinci 30 = 3300s, 55m14'lerin ve 920'in yeniden başlamasıyla ilgili gözlemleri eşleştirmek / 35 gün ( 54.7 dakika başına biri). Her öldürme ilk Durun'u koştu, bu yüzden 0 / 4 "Completed" ve bir kazadan ziyade temiz bir kapatma gibi görünüyordu. Daha önceki 900s/80 değerleri, yorum iddia ettiği gibi soğuk başlangıç ayar değildi - Bunu maskeliyorlardı. Sadece öldürme döngüsünü genişlettiler; önceki 60s / 6 6 Değerler her ~4 dakika (~360/gün) bir yeniden inşa etti. Fix: Aslında dinlediği API'yi, 127.0.0.1'e karşı exec ile ve anlamlı bir eşi geri yükleme (6 x 30s = 3 min). startupProbe zaten kapılar CQL'ye kadar canlılık, bu yüzden ilkDelayİkinciler gereksizdir. Deliberately not ayar -api-address 0.0.0.0, bu, istenmeyen yönetici REST'yi ortaya çıkaracak. API to the pod network.

Tüm değişiklikler

Kargoyu gördüğünüz gibi?

İş alanınızda bu güncellemelerden her biri otomatik olarak. Ücretsiz başlayın ve haftadan sonra büyümesini izleyin.

Sonsuza Kadar Ücretsiz BaşlangıçFırsatları Görüntüle