Claude-API-Kosten verstehen: Opus, Sonnet und Haiku im Preisvergleich
Claude-API-Kosten richten sich nach dem gewählten Modell und der Zahl der verarbeiteten Tokens. Anthropic bietet drei Modellstufen an: Opus als stärkstes Modell, Sonnet als Allrounder und Haiku als schnelles, günstiges Modell. Dazu kommen Rabatte für Caching und Batch, die bei Claude besonders viel ausmachen können.
Die drei Stufen und ihre Preise
Laut Listenpreis kostet Claude Opus 5.5 rund 4 Dollar je Million Eingabe-Tokens und 20 Dollar je Million Ausgabe-Tokens. Claude Sonnet 5.5 liegt bei rund 2 und 10 Dollar, Claude Haiku 4.5 bei rund 1 und 5 Dollar. Die Ausgabe kostet bei allen drei das Fünffache der Eingabe. Die aktuelle Tabelle in Euro:
| Modell | Eingabe / 1 Mio. | Ausgabe / 1 Mio. | Kontext |
|---|---|---|---|
| Claude Haiku 4.5 | 0,89 € | 4,47 € | 200.000 |
| Claude Sonnet 5.5 | 1,79 € | 8,95 € | 1.000.000 |
| Claude Sonnet 4.6 | 2,68 € | 13,42 € | 1.000.000 |
| Claude Opus 5.5 | 3,58 € | 17,89 € | 1.000.000 |
| Claude Opus 5 | 4,47 € | 22,37 € | 1.000.000 |
| Claude Fable 5.1 | 8,95 € | 44,73 € | 1.000.000 |
Listenpreise Stand 07.10.2026, umgerechnet zum EZB-Kurs vom 07.10.2026.
Daneben bietet Anthropic weitere Modelle an, etwa ältere Versionen oder besonders leistungsstarke Varianten zu deutlich höheren Preisen. Einen Überblick geben die Modellseiten.
Tokens zählen bei Claude anders
Claude verwendet einen eigenen Tokenizer. Derselbe deutsche Text ergibt bei Claude in der Regel mehr Tokens als bei OpenAI. Wer Preise je Million Tokens direkt vergleicht, unterschätzt deshalb die Claude-Kosten etwas. Wie viele Tokens Ihr Text ergibt, zeigt der Token-Zähler; Hintergründe stehen im Ratgeber Tokens auf Deutsch und Englisch.
Caching: der größte Hebel bei Claude
Bei Anthropic wird Prompt-Caching ausdrücklich angefordert. Das erste Schreiben in den Cache kostet einen Aufschlag, jeder spätere Treffer nur einen kleinen Teil des Eingabepreises. Bei Claude Opus 5.5 liegt der Preis für gelesene Cache-Tokens bei rund 0,20 Dollar je Million, also einem Zwanzigstel des normalen Eingabepreises. Bei Sonnet 5.5 und Haiku 4.5 ist es ein Zehntel.
Das lohnt sich bei langen Systemanweisungen, Dokumenten, zu denen mehrere Fragen gestellt werden, und bei Agenten, die bei jedem Schritt dieselben Werkzeugbeschreibungen mitschicken. Wie man Prompts dafür aufbaut, erklärt Cached-Input-Preise nutzen.
Batch für alles ohne Eile
Über die Message Batches API kosten Anfragen die Hälfte. Die Ergebnisse kommen innerhalb von 24 Stunden, oft deutlich schneller. Geeignet ist das für Massenaufgaben wie Produkttexte, Übersetzungen oder Auswertungen. Caching und Batch lassen sich kombinieren; was das in Ihrem Fall spart, rechnet der Spar-Rechner.
Welches Modell für welche Aufgabe
- Haiku: Klassifizieren, Daten auslesen, kurze Antworten, Vorfilter in mehrstufigen Abläufen
- Sonnet: Texte, Code, Kundenservice, Agenten im Alltag
- Opus: schwierige Analysen, lange Codeänderungen, Aufgaben mit vielen Schritten
Ein häufiges Muster: Sonnet als Standard, Opus nur für die schwierigen Fälle. Den Kostenunterschied für Ihr Volumen zeigt der KI-Kostenrechner.
Abrechnung
Anthropic rechnet in US-Dollar ab, meist über ein vorab aufgeladenes Guthaben in der Console. Dort lassen sich Verbrauch je Arbeitsbereich verfolgen und Ausgabengrenzen setzen. Das ist ein anderes Modell als das Abo Claude Pro für die Chat-Oberfläche; welches sich lohnt, zeigt Abo oder API.
Häufige Fehler bei der Kalkulation
- Preise je Million Tokens direkt mit OpenAI vergleichen, ohne die höhere Tokenzahl bei deutschen Texten zu berücksichtigen.
- Den Aufschlag für das Schreiben in den Cache vergessen, wenn ein Prompt nur selten wiederverwendet wird.
- Extended Thinking eingeschaltet lassen, obwohl die Aufgabe kein Nachdenken braucht. Denk-Tokens zählen als Ausgabe.
- Für jede Anfrage Opus nutzen, obwohl Sonnet oder Haiku die meisten Fälle genauso gut lösen.
Erstellt mit Unterstützung von KI, geprüft und redaktionell verantwortet von Leon Blatz. Allgemeine Information, keine Rechts-, Steuer- oder Finanzberatung.