- Verschifft
- 18. Juli 2026 um 19:04 UTC
- Autor
- Kamo
- Ausschuss
- 027a0dc
Gefunden durch Sondierung Produktion: org 1188756624575266822 Vision Anrufe gelöst gpt-4o-mini-tts-2025-03-20 - ein TEXT-TO-SPEECH-Modell - so dass jeder Vision Call 502 zurückgegeben hat. Die Dokumentenextraktion und jede andere Visionsfunktion haben für diesen Mieter versagt. Zwei unabhängige Ursachen, beide behoben: gpt-4o-mini-tts, gpt-4o-mini-transcribe und gpt-4o-mini-search-Preview von einem Präfix, so Sprachmodelle wurden als sehbehindert-fähig aufgezeichnet. EXCLUDED_PREFIXES hat sie nicht erwischt weil es passt mit und das sind Suffixe. ModelModality prüft Bindestrich- begrenzende Modalität TOKENS statt, und ist eine Deny-Liste so ein neu veröffentlichtes Chat-Modell Arbeitet weiter. 2. Routing nahm findFirst() auf eine unbeorderte Abfrage, also welches Vision Modell ein Org bekam willkürlich - und es vertraut unterstütztVision, die falsch sein kann (auto-entworben, und Mitglied-bearbeitende in der UI). Es lehnt jetzt Non-Chat-Gelände rundweg und wählt deterministisch, so dass die gleiche org löst sich auf das gleiche Modell jeden Anruf. Angewandt auch die Chat- und Text-Fallbacks: die haben auch models.get(0), die eine Hand Konvation mit einem Einbettungs- oder Sprachmodell. protokolliert auch die upstream Ursache auf einem Vision/Textversagen. Es wurde weggeworfen, so ein 502 sagte nichts über WARUM - ein falsches Modell, ein abgewiesener Schlüssel und ein Netzwerkfehler sahen identisch aus. Das hat in Echtzeit die Diagnose gekostet. Bestehende Reihen, die die schlechte Flagge tragen, müssen noch korrigiert werden; Entdeckung schreibt sie nicht mehr.