수명 조사는 결코 통과 할 수 없었다 - 35 일에서 920 재시작의 원인

FixKlusterServices
관련 상품
2026년 8월 5일 오전 12:11 UTC
이름 *
Kamo
뚱 베어
00ad3ef

뿌리 원인: 생동감 조사는 `tcpSocket: 포트 10000`, 하지만 Scylla의 REST API tcpSocket probe가 POD를 다이얼하면서 api address 127.0.0.1 (its default)에 바인딩합니다. IP. 컨테이너 내부에서 검증된 - /proc/net/tcp show :10000 청취 0100007F (127.0.0.1)에, 9042/9180/7000/19042는 포드 IP에 있습니다; 그리고 카지노사이트 반환 200 동일한 요청 동안 파드 IP에 대한 거부 (curl Exit 7), 이는 정확히 무엇 쿠버렛보고: "Liveness probe failed : 다이얼 tcp 10.42.0.47 :10000 : 연결 : 거부". 그래서 프로브는 모든 시도에 실패하고 쿠버렛은 용기를 모두 죽였다. 주기: initialDelaySeconds 900 + 실패 80 x periodSeconds 30 = 3300s, 55m14s 및 920 재시작 / 35 일의 재시작 기간 일치 (54.7분당 1회) 각 죽이는 preStop `nodetool drain`, 그래서 0을 종료 / "Completed"과 충돌보다 깨끗한 폐쇄처럼 보입니다. 이전 900s/80 값은 추락되지 않았습니다. 그들은 이것을 마쳤다. 그들은 단지 죽이는 주기를 기지개했습니다; 60s/의 앞에 6개 각 ~4분(~360/일)을 재시작합니다. 수정 : 실제로 127.0.0.1에 대한 실행을 통해 API를 작성하고, 의미있는 임계값 (6 x 30s = 3 분)을 복원합니다. startProbe 이미 게이트 CQL까지 생동감이 높기 때문에 초기DelaySeconds가 불필요합니다. 부정 행위 설정 --api-address 0.0.0.0, 이는 unauthenticated admin REST 노출 pod 네트워크에 API.

모든 변경 사항

배송을 보는 것과 같이?

작업 공간의 모든 업데이트 땅은 자동으로. 일주일 후 무료로 시청하십시오.

무료 영원히 시작가격 비교