Stoppen Sie die Routing-Vision zu Text-to-Speech-Modellen

FixAIService
Verschifft
18. Juli 2026 um 19:04 UTC
Autor
Kamo
Ausschuss
027a0dc

Gefunden durch Sondierung Produktion: org 1188756624575266822 Vision Anrufe gelöst gpt-4o-mini-tts-2025-03-20 - ein TEXT-TO-SPEECH-Modell - so dass jeder Vision Call 502 zurückgegeben hat. Die Dokumentenextraktion und jede andere Visionsfunktion haben für diesen Mieter versagt. Zwei unabhängige Ursachen, beide behoben: gpt-4o-mini-tts, gpt-4o-mini-transcribe und gpt-4o-mini-search-Preview von einem Präfix, so Sprachmodelle wurden als sehbehindert-fähig aufgezeichnet. EXCLUDED_PREFIXES hat sie nicht erwischt weil es passt mit und das sind Suffixe. ModelModality prüft Bindestrich- begrenzende Modalität TOKENS statt, und ist eine Deny-Liste so ein neu veröffentlichtes Chat-Modell Arbeitet weiter. 2. Routing nahm findFirst() auf eine unbeorderte Abfrage, also welches Vision Modell ein Org bekam willkürlich - und es vertraut unterstütztVision, die falsch sein kann (auto-entworben, und Mitglied-bearbeitende in der UI). Es lehnt jetzt Non-Chat-Gelände rundweg und wählt deterministisch, so dass die gleiche org löst sich auf das gleiche Modell jeden Anruf. Angewandt auch die Chat- und Text-Fallbacks: die haben auch models.get(0), die eine Hand Konvation mit einem Einbettungs- oder Sprachmodell. protokolliert auch die upstream Ursache auf einem Vision/Textversagen. Es wurde weggeworfen, so ein 502 sagte nichts über WARUM - ein falsches Modell, ein abgewiesener Schlüssel und ein Netzwerkfehler sahen identisch aus. Das hat in Echtzeit die Diagnose gekostet. Bestehende Reihen, die die schlechte Flagge tragen, müssen noch korrigiert werden; Entdeckung schreibt sie nicht mehr.

Alle Änderungen

Wie, was Sie sehen Versand?

Jedes dieser Updates landet automatisch in Ihrem Arbeitsbereich. Starten Sie frei und beobachten Sie es Woche für Woche wachsen.

Free Forever startenPreisgestaltung anzeigen