- Spegnimento
- 10 maggio 2026 alle ore 09:04 UTC
- Autore
- Kamo
- Impegno
- 929eba5
Una singola replica è il collo di bottiglia per il flusso di lavoro di sincronizzazione del dizionario: ogni operaio di gunicorn gestisce una richiesta poi auto-restri (~5-10s finestra di connessione-rifusa), e il 2-CPU limite tappi inferenza - Grazie. Con entrambe le chiamate runtime e una sincronizzazione 12k-string la stessa istanza, richiede la coda oltre il per-call di TranslateService timeout (ora 90s) e la maggior parte dei pezzi tempo fuori — l'ultima corsa di sincronizzazione completa ha preso 3 ore e prodotto solo 2,9% cinese in zh.json. Due repliche doppia CPU efficace (4 core totali) e raddoppiare il piscina operaia di gunicorn, dando richieste da qualche parte a terra mentre uno Il lavoratore sta riciclando. Entrambi i pod programma su k1m1 (solo nodo con il hostPath /var/lib/libretranslate dove vivono i pacchetti argos); k1m1 ha ampio headroom (~92% CPU gratuito, ~67% memoria gratis).