API-Fehler bei KI-Diensten behandeln: 429, 500 und Zeitüberschreitungen
API-Fehler gehören bei KI-Diensten zum Alltag: Lastspitzen, Ratenbegrenzungen und Zeitüberschreitungen kommen regelmäßig vor. Eine robuste Anwendung fängt sie ab, statt Nutzern eine Fehlermeldung zu zeigen.
Die häufigsten Fehler
- 429 Too Many Requests: Sie haben die Grenze für Anfragen oder Tokens pro Minute überschritten.
- 500, 502, 503, 529: Fehler oder Überlastung beim Anbieter, meist vorübergehend.
- Zeitüberschreitung: Lange Antworten oder Denkphasen dauern länger als das eingestellte Limit.
- 400 Bad Request: Fehler in Ihrer Anfrage, etwa zu viele Tokens oder ungültige Parameter. Wiederholen hilft hier nicht.
Richtig wiederholen
- Nur bei vorübergehenden Fehlern wiederholen (429, 5xx, Zeitüberschreitung).
- Wartezeit schrittweise verlängern, etwa 1, 2, 4, 8 Sekunden, mit etwas Zufall.
- Angaben wie „retry-after“ in der Antwort beachten.
- Nach drei bis fünf Versuchen aufgeben und sauber reagieren.
Die offiziellen SDKs der Anbieter wiederholen viele Fehler bereits automatisch.
Weitere Schutzmaßnahmen
- Ausweichmodell: Bei anhaltenden Fehlern auf ein anderes Modell oder einen anderen Anbieter wechseln.
- Streaming bei langen Antworten, um Zeitlimits zu vermeiden.
- Ungültige Antworten prüfen, etwa kaputtes JSON, und gezielt neu anfordern; siehe JSON-Fehler in KI-Antworten.
- Grenzen planen: Wie viele Anfragen Ihre Stufe schafft, zeigt der Durchsatz-Rechner.
Erstellt mit Unterstützung von KI, geprüft und redaktionell verantwortet von Leon Blatz. Allgemeine Information, keine Rechts-, Steuer- oder Finanzberatung.
Durchsatz-RechnerWie lange 10.000 Anfragen bei Rate Limits dauern und was der Engpass ist.
Öffnen