Sonda na żywo nigdy nie mogła przejść – przyczyna ponownego uruchomienia 920 w ciągu 35 dni

FixKlusterServices
Szycy
5 sierpnia 2026 00:11 UTC
Autor
Kamo
Pochęt się
00ad3ef

Przyczyna korzeni: sonda na żywo była "tcpSocket: port 10000", ale Scylla's REST API wiąże się z api_adres 127.0.0.1 (jego domyślnie), podczas gdy sonda tcpSocket wybiera POD IP. Zweryfikowano z wnętrza pojemnika — /proc/net/tcp pokazuje tylko odsłuch :10000 w dniu 0100007F (127.0.0.1), natomiast 9042/9180/7000/19042 znajduje się na strof IP; oraz - curl - zwrot 200, podczas gdy to samo żądanie Do podnicy odmówiono (wyjście z korki 7), co jest dokładnie tym, co donosił kubelet: Sonda na żywo nie powiodła się: wybierz tcp 10.42.0.47:10000: connect: odrzucone połączenie. Więc sonda nie powiodła się przy każdej próbie, a kubelet zabił kontenera. cykl: początkowyPrzelanie PROJednocja 900 + awaria Prostota 80 x okres Skromności 30 x 3300 s, Dopasowanie obserwowanego okresu restartu wynoszącego 55m14s i 920 restartów / 35 dni (jeden na 54,7 min). Każde zabójstwo uruchomiło preStop "nodetool drain", więc wyszedł 0 / "Ukończona" i wyglądała jak czyste zamknięcie, a nie katastrofa. Wcześniejsze wartości 900/80 nie były dostrajaniem na zimno, jak twierdzi komentarz – Oni to maskowali. Rozciągali tylko cykl zabijania; poprzednie 60s/6 Wartościowe spowodowały ponowne uruchomienie co 4 minuty (360 euro/dzień). Fix: sonduj API, gdzie faktycznie odsłucha, przez exec przeciwko 127.0.0.1, i Przywróć znaczący próg (6 x 30 x 3 min). UruchomienieProbe już bramy Żywotność do czasu ubytku CQL, więc początkowe PrzepaściSeconds są niepotrzebne. Celowo nie, Ustawienie --api-adres 0.0.0.0, który odsłoniłby nieuwierzytelnioną admin REST API do sieci kapsuł.

Wszystkie zmiany

Jak to, co widzisz żeglugę?

Każda z tych aktualizacji automatycznie ląduje w miejscu pracy. Zacznij za darmo i obserwuj, jak rośnie tydzień po tygodniu.

Start Free ForeverZobacz ceny