Máy dò không bao giờ qua được — nguyên nhân 920 khởi động lại trong 35 ngày

FixKlusterServices
Shipped
lúc 00:11 5 tháng 8, 2026 UTC
Author
Kamo
Commit
00ad3ef

Nguyên nhân gốc: thăm dò còn sống là <tccpSocket: cổng 10000`, nhưng Scylla's RES API Cột vào mũ 127.0. 1 (mặc định) trong khi tcpSet thăm dò quay số PD IP. vào 0100007F (127.0.1), trong khi 9042/9180/7000/19042 là trên IP, và GenericName trả lại 200 trong khi cùng yêu cầu không chấp nhận địa chỉ IP trong tàu. Việc thăm dò sự sống thất bại: quay số Tcp 10.42.0.47: 100,000: kết nối: kết nối bị từ chối. Vì vậy, các vệ tinh thăm dò thất bại trong mỗi nỗ lực và kubeet đã giết các container mỗi Chu kỳ: bắt đầuDelaySecond 900 + thất bại Threshold 80 giai đoạn x 30 = 3300, phù hợp với khoảng thời gian quan sát bắt đầu lại 55m14s và 920 khởi động lại / 35 ngày (~1 trên 54.7 phút). Mỗi cái chết chạy trước khi dừng 'nodethole', vì vậy nó thoát ra 0 / / "Đã hoàn thành" và trông giống như một sự tắt máy sạch hơn là một vụ tai nạn. Các giá trị trước 900/80 đã không được điều chỉnh lạnh như bình luận tuyên bố - Họ đang che giấu chuyện này. Chúng chỉ kéo dài chu kỳ giết chóc; những năm 60 trước đó. 6 giá trị tạo ra một khởi động lại mỗi ~4 phút (~360/day). Sửa chữa: thăm dò ADI nơi nó thực sự lắng nghe, thông qua exec chống lại 127.0.0.1, và Phục hồi một ngưỡng đầy ý nghĩa (6 x 30s = 3 phút). Khởi động chương trình đã mở cổng Cuộc sống cho đến khi CQL kết thúc, vì vậy ban đầu DelaySconds là không cần thiết. Không cố ý thiết lập --api- mũ 0.0.0, mà sẽ phơi bày admin Rest chưa được chứng thực ARI gọi mạng tàu.

All changes

Như những gì anh thấy vận chuyển?

Mỗi một bản cập nhật này đều được tự động cập nhật trong không gian làm việc của bạn. Bắt đầu tự do và xem nó lớn lên tuần này qua tuần khác.

Bắt đầu tự do mãi mãiXem truy cập