- Spegnimento
- 28 settembre 2026 alle ore 10:06 UTC
- Autore
- Kamo
- Impegno
- c9be36f
HuggingFaceAdapter è stato trasmesso attraverso l'impostazione predefinita dell'interfaccia: ogni pezzo era leggere per il suo testo e nient'altro, quindi nessun utilizzo mai raggiunto l'esecutore o membro chat e ogni risposta in streaming è stato misurato come una stima chars/4. Il flusso ora chiede per l'utilizzo (stream options. includere usage, nella spec chat-completion del router) e legge ogni pezzo per il suo testo, finish reason e l'uso. Un router che rifiuta la domanda viene chiesto di nuovo senza di esso dal ParameterFallback dell'esecutore; un flusso senza un uso chunk rimane un preventivo, contrassegnato come uno. Una risposta cut-off ora termina come max tokens invece di lettura come finito. Il flusso non stampa più il corpo di richiesta (il prompt) a Stdout. SP99-T12.
