OpenAI-API-Kosten verstehen: Modellstufen, Abrechnung und Rabatte
OpenAI-API-Kosten entstehen nicht pro Monat, sondern pro verarbeitetem Token. Wer die Rechnung verstehen will, muss drei Dinge kennen: die Modellstufe, das Verhältnis von Eingabe zu Ausgabe und die Rabatte für gecachte Eingaben und Batch-Anfragen. Dieser Ratgeber erklärt die Struktur; konkrete Rechenbeispiele für typische Anwendungen finden Sie unter ChatGPT API Kosten.
Die Modellstufen bei OpenAI
OpenAI bietet mehrere Modellfamilien parallel an, und innerhalb jeder Familie gibt es Abstufungen. Grob lassen sich vier Preisklassen unterscheiden:
- Sehr kleine Modelle (etwa GPT-6 Luna oder die nano-Varianten): Bruchteile eines Dollars je Million Eingabe-Tokens. Gedacht für Klassifizieren, Auslesen, einfache Antworten in großer Menge.
- Kleine Modelle (mini-Varianten): etwas teurer, deutlich besser bei Texten und einfachen Analysen.
- Mittlere Modelle (etwa GPT-6.1 Sol): rund 2 Dollar Eingabe und 10 Dollar Ausgabe je Million Tokens. Der übliche Standard für anspruchsvolle Anwendungen.
- Spitzenmodelle (etwa GPT-6 Astra mit rund 10 Dollar Eingabe und 50 Dollar Ausgabe): für schwierige Aufgaben, bei denen Qualität wichtiger ist als Preis.
Zwischen der günstigsten und der teuersten Stufe liegt ein Faktor von mehr als hundert. Die Modellwahl ist deshalb der größte einzelne Kostenhebel.
Aktuelle Preise in Euro
| Modell | Eingabe / 1 Mio. | Ausgabe / 1 Mio. | Kontext |
|---|---|---|---|
| GPT-5 nano | 0,045 € | 0,36 € | 400.000 |
| GPT-6 Luna | 0,089 € | 0,45 € | 1.050.000 |
| GPT-4o mini | 0,13 € | 0,54 € | 128.000 |
| GPT-5.6 Luna | 0,18 € | 1,07 € | 1.050.000 |
| GPT-5.4 nano | 0,18 € | 1,12 € | 400.000 |
| GPT-5 mini | 0,22 € | 1,79 € | 400.000 |
| GPT-5.4 mini | 0,67 € | 4,03 € | 400.000 |
| GPT-5 | 1,12 € | 8,95 € | 400.000 |
| o3 | 1,79 € | 7,16 € | 200.000 |
| GPT-6.1 Sol | 1,79 € | 8,95 € | 1.050.000 |
| GPT-6 Sol | 1,79 € | 8,95 € | 1.050.000 |
| GPT-5.6 Terra | 1,79 € | 10,74 € | 1.050.000 |
| GPT-4o | 2,24 € | 8,95 € | 128.000 |
| GPT-5.4 | 2,24 € | 13,42 € | 1.050.000 |
| GPT-5.6 Sol | 3,58 € | 17,89 € | 1.050.000 |
| GPT-5.5 | 4,47 € | 26,84 € | 1.000.000 |
| GPT-6 Astra | 8,95 € | 44,73 € | 1.050.000 |
Listenpreise Stand 07.10.2026, umgerechnet zum EZB-Kurs vom 07.10.2026.
Die Tabelle wird bei jeder Aktualisierung der Website aus den Listenpreisen erzeugt. Details zu jedem Modell stehen auf den Modellseiten.
Wie die Rechnung zustande kommt
Jede Anfrage besteht aus Eingabe-Tokens (Systemanweisung, Verlauf, Dokumente, Frage) und Ausgabe-Tokens (die Antwort). Beide werden getrennt mit dem jeweiligen Preis multipliziert. Bei OpenAI kostet die Ausgabe meist das Fünf- bis Sechsfache der Eingabe. Dazu kommen drei Sonderfälle:
- Gecachte Eingabe: Wiederholt sich der Anfang eines Prompts, berechnet OpenAI diesen Teil automatisch günstiger, bei vielen aktuellen Modellen mit einem Zehntel des normalen Eingabepreises.
- Reasoning-Tokens: Denkt ein Modell vor der Antwort nach, werden diese internen Tokens als Ausgabe berechnet.
- Batch: Anfragen, die nicht sofort fertig sein müssen, kosten über die Batch-Schnittstelle die Hälfte.
Kosten vor dem Start schätzen
Für eine belastbare Schätzung brauchen Sie nur wenige Zahlen: Anfragen pro Monat, durchschnittliche Eingabe- und Ausgabelänge in Tokens und das gewünschte Modell. Die Länge eines typischen Prompts misst der Token-Zähler, die Monatskosten rechnet der KI-Kostenrechner. Planen Sie einen Puffer ein: In der Praxis werden Prompts mit der Zeit länger, und Wiederholungen nach Fehlern kosten mit.
Abrechnung und Zahlungsweise
OpenAI rechnet in US-Dollar ab, in der Regel über ein Guthaben, das vorab aufgeladen wird. Wie Dollar-Beträge in der Buchhaltung umgerechnet werden, zeigt der Rechner Dollar-Rechnung in Euro. Im Dashboard lassen sich Verbrauch je Projekt und Modell einsehen und Grenzen festlegen; wie Sie das sinnvoll einrichten, beschreibt Ausgabenlimits für KI-APIs setzen.
Typische Kostenfallen
- Ein Spitzenmodell für Aufgaben, die ein kleines Modell ebenso gut löst
- Lange Chatverläufe, die bei jeder Nachricht komplett mitgeschickt werden
- Kein Limit für die Antwortlänge
- Reasoning auf höchster Stufe für einfache Fragen
Weitere Sparhebel bündelt der Ratgeber KI-Kosten senken.
Erstellt mit Unterstützung von KI, geprüft und redaktionell verantwortet von Leon Blatz. Allgemeine Information, keine Rechts-, Steuer- oder Finanzberatung.