- Expédié
- 25 août 2026 à 15:34 UTC
- Auteur
- Kamo
- Commite
- 3342ccd
Deux écarts, tous deux prouvés contre le groupe vivant aujourd'hui. PREMIER: chaque alerte KamoDesktop qui existe est-il en train de mesurer si un COMPOSANT est vivant. Tous les quatre étaient verts pendant la panne 2026-08-25 et le critère d'évaluation du RDP prêt, agent prêt, guacamole 1/1, guacd 1/1 - tandis que personne ne pouvait se connecter, parce que le SSO token's expirer la liste des connexions de la session. La vie n'est pas visible que. Donc le canari marche sur tout le chemin qu'une personne marche : SecurityService empile sur une vrai lien, il est échangé à la passerelle PUBLIC url (exerçant DNS, le le certificat et le routage de Traefik plutôt que de les contourner), le bureau doit apparaissent dans le répertoire de connexion, et une session ouverte sur un cycle EARLIER doit encore énumérer ses connexions. Cette dernière étape est la question. La coupure a laissé de nouvelles connexions en état de fonctionner et s'est cassée se reconnecte uniquement, de sorte qu'une sonde qui se loge à chaque fois jamais vu jamais c'est ça. Vérifié bout à bout contre la porte d'entrée en direct avec un court instant Fenêtre: frais de connexion vert, séance en rouge, exactement la signature de coupure. Il n'ouvre PAS une véritable session du RDP. xrdp keys sessions sur "utilisateur, profondeur de la couleur" et la profondeur de couleur est épinglée de sorte que vous connectez REJOIND one de bureau et une sonde d'enregistrement comme un membre réel s'attacherait à leur session en direct et les déconnecterait tous les quelques minutes. Deux contrôles TCP plus la couverture d'alerte existante pour la préparation du point d'extrémité jambe sans expulser qui que ce soit. DEUXIEME, et la véritable raison pour laquelle un bureau cassé n'a pu être trouvé qu'en l'essayant : Le seul récepteur d'alerte était littéralement un récepteur appelé "null", et chaque alerte dans le groupe y a été acheminé. Les règles étaient en train de tirer correctement; rien n'était écouter. Les alertes vont maintenant à SysAdmin-KamoCRM.com via le postfix du cluster et au fil de discussion d'un membre. Livré comme animateur d'alerteConfig CR parce que est appliqué à la main et n'est pas un IC Critique - routage qui n'existe qu'après que quelqu'un a re-réoulvé un script est le même la classe de problème en tant que règle que personne n'a appliqué. Les nouvelles alertes couvrent une connexion cassée, des reconnexions cassées, une interruption certificat, et un canari STALE - une sonde qui empêche les rapports ne doit jamais être lue comme en bonne santé, puisque le silence est le mode de défaillance, tout ce pipeline s'enlève. La sonde est livrée sous la forme d'une ConfigMap sur une image python stock (bibliothèque standard uniquement), donc il n'y a pas de deuxième image à maintenir patché pour la vie du cluster, et IC les portes du déploiement sur ses 17 essais unitaires: un canari qui fait état de son succès silencieusement est Pire que pas de canari.