Skalieren Sie auf 2 Repliken, um Synchronisation + Laufzeitverkehr zu absorbieren

FixKlusterServices
Verschifft
10. Mai 2026 um 09:04 UTC
Autor
Kamo
Ausschuss
929eba5

Eine einzelne Replik ist der Flaschenhals für den Wörterbuch-Sync-Workflow: jeder Gunicorn-Arbeiter bearbeitet eine Anfrage, dann Auto-Restarts (ca. 5-10s Fenster von Verbindung-verweigert), und die 2-CPU-Limitkappen Schlussfolgerung Durchsatz. Mit beiden Runtime-Anrufern und einem 12k-String-Synchronisation die gleiche Instanz, Anfragen Warteschlange Vergangenheit TranslateService pro Anruf Timeout (jetzt 90er) und die meisten Brocken Auszeit - der letzte vollständige Sync-Lauf nahm 3+ Stunden und produzierte nur 2,9% Chinesisch in zh.json. Zwei Repliken verdoppeln effektive CPU (4 Kerne insgesamt) und doppelt die gunicorn Arbeiter Pool, geben Anfragen irgendwo zu landen, während eine Arbeiter ist Recycling. Beide Pods Zeitplan auf k1m1 (nur Knoten mit der hostPath /var/lib/libretranslate wo argos Pakete leben); k1m1 hat viel Kopffreiheit (ca. 92% CPU frei, 67% speicherfrei).

Alle Änderungen

Wie, was Sie sehen Versand?

Jedes dieser Updates landet automatisch in Ihrem Arbeitsbereich. Starten Sie frei und beobachten Sie es Woche für Woche wachsen.

Free Forever startenPreisgestaltung anzeigen