API-Fehler bei KI-Diensten behandeln: 429, 500 und Zeitüberschreitungen

1 Min. LesezeitStand 07.10.2026Mit KI erstellt · redaktionell geprüft

API-Fehler gehören bei KI-Diensten zum Alltag: Lastspitzen, Ratenbegrenzungen und Zeitüberschreitungen kommen regelmäßig vor. Eine robuste Anwendung fängt sie ab, statt Nutzern eine Fehlermeldung zu zeigen.

Die häufigsten Fehler

  • 429 Too Many Requests: Sie haben die Grenze für Anfragen oder Tokens pro Minute überschritten.
  • 500, 502, 503, 529: Fehler oder Überlastung beim Anbieter, meist vorübergehend.
  • Zeitüberschreitung: Lange Antworten oder Denkphasen dauern länger als das eingestellte Limit.
  • 400 Bad Request: Fehler in Ihrer Anfrage, etwa zu viele Tokens oder ungültige Parameter. Wiederholen hilft hier nicht.

Richtig wiederholen

  1. Nur bei vorübergehenden Fehlern wiederholen (429, 5xx, Zeitüberschreitung).
  2. Wartezeit schrittweise verlängern, etwa 1, 2, 4, 8 Sekunden, mit etwas Zufall.
  3. Angaben wie „retry-after“ in der Antwort beachten.
  4. Nach drei bis fünf Versuchen aufgeben und sauber reagieren.

Die offiziellen SDKs der Anbieter wiederholen viele Fehler bereits automatisch.

Weitere Schutzmaßnahmen

  • Ausweichmodell: Bei anhaltenden Fehlern auf ein anderes Modell oder einen anderen Anbieter wechseln.
  • Streaming bei langen Antworten, um Zeitlimits zu vermeiden.
  • Ungültige Antworten prüfen, etwa kaputtes JSON, und gezielt neu anfordern; siehe JSON-Fehler in KI-Antworten.
  • Grenzen planen: Wie viele Anfragen Ihre Stufe schafft, zeigt der Durchsatz-Rechner.

Erstellt mit Unterstützung von KI, geprüft und redaktionell verantwortet von Leon Blatz. Allgemeine Information, keine Rechts-, Steuer- oder Finanzberatung.

Durchsatz-RechnerWie lange 10.000 Anfragen bei Rate Limits dauern und was der Engpass ist.
Öffnen

Auch hilfreich: JSON formatieren · JSON reparieren

Weiterlesen

Weitere Artikel

  1. KI-Chatbot für die Website: Planung, Kosten und PflichtenKI-Chatbot für die Website: Fertiglösung oder selbst gebaut, was ein Chatbot pro Gespräch kostet, wie er Ihr Wissen nutzt und welche Hinweise Pflicht sind.
  2. Vektordatenbanken erklärt: Das Gedächtnis von RAG-AnwendungenVektordatenbanken erklärt: Wie sie Texte nach Bedeutung statt Stichworten finden, welche es gibt, wann normale Datenbanken reichen und was sie kosten.
  3. RAG einfach erklärt: KI mit eigenen Dokumenten nutzenRAG einfach erklärt: wie Retrieval-Augmented Generation funktioniert, wofür man Embeddings und Vektordatenbanken braucht und was ein RAG-System kostet.