Retry-Backoff-Rechner

Der Retry-Backoff-Rechner zeigt Wartezeiten für Wiederholungen bei API-Fehlern wie 429: exponentiell, mit Obergrenze und Jitter, samt Python-Beispiel.

–

 

VersuchWartezeitGesamt bis dahin
Python-Beispiel

Exponentielles Backoff

Bei Fehlern wie 429 (Rate Limit) oder 529 (Überlastung) sollte eine Anwendung nicht sofort und nicht unendlich oft wiederholen. Bewährt ist exponentielles Backoff: Die Wartezeit wächst mit jedem Versuch, bis zu einer Obergrenze, mit einem Zufallsanteil, damit nicht alle Anfragen gleichzeitig wiederkommen.

Der Rechner zeigt die Wartezeiten je Versuch und die Gesamtdauer im schlimmsten Fall und erzeugt ein Python-Beispiel. Die offiziellen SDKs der Anbieter bringen solche Wiederholungen bereits mit.

Fragen

Häufige Fragen

Was ist Jitter?

Ein Zufallsanteil der Wartezeit. Er verhindert, dass viele Anfragen nach einem Fehler gleichzeitig wiederkommen.

Wie oft sollte ich wiederholen?

Meist drei bis sechs Mal. Danach lieber sauber abbrechen oder auf ein anderes Modell ausweichen.

Soll ich bei jedem Fehler wiederholen?

Nur bei vorübergehenden Fehlern wie 429, 500, 503, 529 und Zeitüberschreitungen, nicht bei 400 oder 401.

Ratgeber

Zum Weiterlesen

Alle Artikel
  1. RAG einfach erklärt: KI mit eigenen Dokumenten nutzenRAG einfach erklärt: wie Retrieval-Augmented Generation funktioniert, wofür man Embeddings und Vektordatenbanken braucht und was ein RAG-System kostet.
  2. Structured Outputs: Zuverlässig JSON von KI-ModellenStructured Outputs erklärt: Wie Sie mit JSON-Schema garantiert gültiges JSON von OpenAI, Claude und Gemini bekommen, statt kaputte Antworten nachträglich zu reparieren.
  3. Prompt Injection: Wie Angriffe auf KI-Systeme funktionierenPrompt Injection erklärt: wie versteckte Anweisungen in E-Mails, Dokumenten und Websites KI-Assistenten und Agenten manipulieren und welche Schutzmaßnahmen wirken.
Weitere Werkzeuge

Das könnte auch helfen

Alle 115 Werkzeuge