Retry-Backoff-Rechner
Der Retry-Backoff-Rechner zeigt Wartezeiten für Wiederholungen bei API-Fehlern wie 429: exponentiell, mit Obergrenze und Jitter, samt Python-Beispiel.
| Versuch | Wartezeit | Gesamt bis dahin |
|---|
Exponentielles Backoff
Bei Fehlern wie 429 (Rate Limit) oder 529 (Überlastung) sollte eine Anwendung nicht sofort und nicht unendlich oft wiederholen. Bewährt ist exponentielles Backoff: Die Wartezeit wächst mit jedem Versuch, bis zu einer Obergrenze, mit einem Zufallsanteil, damit nicht alle Anfragen gleichzeitig wiederkommen.
Der Rechner zeigt die Wartezeiten je Versuch und die Gesamtdauer im schlimmsten Fall und erzeugt ein Python-Beispiel. Die offiziellen SDKs der Anbieter bringen solche Wiederholungen bereits mit.
Häufige Fragen
Was ist Jitter?
Ein Zufallsanteil der Wartezeit. Er verhindert, dass viele Anfragen nach einem Fehler gleichzeitig wiederkommen.
Wie oft sollte ich wiederholen?
Meist drei bis sechs Mal. Danach lieber sauber abbrechen oder auf ein anderes Modell ausweichen.
Soll ich bei jedem Fehler wiederholen?
Nur bei vorübergehenden Fehlern wie 429, 500, 503, 529 und Zeitüberschreitungen, nicht bei 400 oder 401.
Zum Weiterlesen
- RAG einfach erklärt: KI mit eigenen Dokumenten nutzenRAG einfach erklärt: wie Retrieval-Augmented Generation funktioniert, wofür man Embeddings und Vektordatenbanken braucht und was ein RAG-System kostet.
- Structured Outputs: Zuverlässig JSON von KI-ModellenStructured Outputs erklärt: Wie Sie mit JSON-Schema garantiert gültiges JSON von OpenAI, Claude und Gemini bekommen, statt kaputte Antworten nachträglich zu reparieren.
- Prompt Injection: Wie Angriffe auf KI-Systeme funktionierenPrompt Injection erklärt: wie versteckte Anweisungen in E-Mails, Dokumenten und Websites KI-Assistenten und Agenten manipulieren und welche Schutzmaßnahmen wirken.
Das könnte auch helfen
JSON formatierenneu
JSON formatieren, prüfen und minifizieren, mit Fehlerstelle und Tokenzahl.
ÖffnenJSON reparierenneu
Kaputtes JSON aus KI-Antworten reparieren: Codeblöcke, Kommas, Anführungszeichen.
ÖffnenBatch-Datei-Generatorneu
Aus einer Vorlage und einer Liste viele Prompts erzeugen, als JSONL für die Batch-APIs.
ÖffnenAPI-Anfrage-Generatorneu
Fertige cURL-Anfragen für die APIs von OpenAI, Anthropic und Google erzeugen.
ÖffnenPrompt-Injection-Prüferneu
Fremde Texte vor der KI-Verarbeitung auf versteckte Anweisungen und Tricks prüfen.
ÖffnenJSON-Schema-Generator
Aus einem JSON-Beispiel ein JSON Schema für strukturierte Ausgaben von KI-Modellen erzeugen.
Öffnen