Sonda Living nu ar putea trece niciodată cauza 920 reporniri în 35 de zile

FixKlusterServices
Expediere
5 august 2026 la 00:11 UTC
Autor
Kamo
Comite
00ad3ef

Cauza root: sonda liveness a fost se leagă de api adresa 127.0.1 (implicit) în timp ce o sondă tcpSocket formează POD IP. Verificat din interiorul containerului /proc/net/tcp shows :10000 ascultare numai la 0100007F (127.0.01), în timp ce 90429180/7000/19042 se află pe capsula IP; și Nu-ţi face griji. întoarce 200 în timp ce aceeași cerere se refuză capsula IP (ieșirea recul 7), care este exact ceea ce a raportat kubelet: "Standardul de activitate a eşuat: dial tcp 10.42.0.47:10000: conexiune: conexiune refuzată." Sonda a eşuat la fiecare încercare şi Kubelet a ucis fiecare container. ciclu: iniţialDelays Seconds 900 + failureThreshold 80 x periodsSeconds 30 = 3300s; Potrivire perioada de repornire observată de 55m14s și 920 reporniri / 35 zile (~1 per 54,7 min). Fiecare ucide a fugit preStop drenaj toc, astfel încât a ieșit 0 / "Completed" şi arăta ca o închidere curată, mai degrabă decât un accident. Valorile anterioare 900s/80 nu au fost la rece-start tuning, așa cum a afirmat comentariul Au ascuns asta. Ei au întins doar ciclul ucide; 60 anterioare / 6 valorile au produs o repornire la fiecare ~4 min (~360/zi). Fix: sonda API în cazul în care ascultă efectiv, prin exec împotriva 127.0.01 și restabilirea unui prag semnificativ (6 x 30 = 3 min). StartupProbe are deja porți liveness până CQL este de până, astfel încât iniţialDelaySeconds este inutil. Deliberat nu. setare --appi-adresa 0.0.0, care ar expune admin neautentice API către reţeaua de navete.

Toate modificările

Ca ceea ce vezi de transport maritim?

Fiecare dintre aceste actualizări aterizează automat în spațiul de lucru. Începe gratuit și urmăriți-l crească săptămână după săptămână.

Pornește gratuit pentru totdeaunaVezi prețurile