Claude-API-Kosten verstehen: Opus, Sonnet und Haiku im Preisvergleich

2 Min. LesezeitStand 08.10.2026Mit KI erstellt · redaktionell geprüft

Claude-API-Kosten richten sich nach dem gewählten Modell und der Zahl der verarbeiteten Tokens. Anthropic bietet drei Modellstufen an: Opus als stärkstes Modell, Sonnet als Allrounder und Haiku als schnelles, günstiges Modell. Dazu kommen Rabatte für Caching und Batch, die bei Claude besonders viel ausmachen können.

Die drei Stufen und ihre Preise

Laut Listenpreis kostet Claude Opus 5.5 rund 4 Dollar je Million Eingabe-Tokens und 20 Dollar je Million Ausgabe-Tokens. Claude Sonnet 5.5 liegt bei rund 2 und 10 Dollar, Claude Haiku 4.5 bei rund 1 und 5 Dollar. Die Ausgabe kostet bei allen drei das Fünffache der Eingabe. Die aktuelle Tabelle in Euro:

ModellEingabe / 1 Mio.Ausgabe / 1 Mio.Kontext
Claude Haiku 4.50,89 €4,47 €200.000
Claude Sonnet 5.51,79 €8,95 €1.000.000
Claude Sonnet 4.62,68 €13,42 €1.000.000
Claude Opus 5.53,58 €17,89 €1.000.000
Claude Opus 54,47 €22,37 €1.000.000
Claude Fable 5.18,95 €44,73 €1.000.000

Listenpreise Stand 07.10.2026, umgerechnet zum EZB-Kurs vom 07.10.2026.

Daneben bietet Anthropic weitere Modelle an, etwa ältere Versionen oder besonders leistungsstarke Varianten zu deutlich höheren Preisen. Einen Überblick geben die Modellseiten.

Tokens zählen bei Claude anders

Claude verwendet einen eigenen Tokenizer. Derselbe deutsche Text ergibt bei Claude in der Regel mehr Tokens als bei OpenAI. Wer Preise je Million Tokens direkt vergleicht, unterschätzt deshalb die Claude-Kosten etwas. Wie viele Tokens Ihr Text ergibt, zeigt der Token-Zähler; Hintergründe stehen im Ratgeber Tokens auf Deutsch und Englisch.

Caching: der größte Hebel bei Claude

Bei Anthropic wird Prompt-Caching ausdrücklich angefordert. Das erste Schreiben in den Cache kostet einen Aufschlag, jeder spätere Treffer nur einen kleinen Teil des Eingabepreises. Bei Claude Opus 5.5 liegt der Preis für gelesene Cache-Tokens bei rund 0,20 Dollar je Million, also einem Zwanzigstel des normalen Eingabepreises. Bei Sonnet 5.5 und Haiku 4.5 ist es ein Zehntel.

Das lohnt sich bei langen Systemanweisungen, Dokumenten, zu denen mehrere Fragen gestellt werden, und bei Agenten, die bei jedem Schritt dieselben Werkzeugbeschreibungen mitschicken. Wie man Prompts dafür aufbaut, erklärt Cached-Input-Preise nutzen.

Batch für alles ohne Eile

Über die Message Batches API kosten Anfragen die Hälfte. Die Ergebnisse kommen innerhalb von 24 Stunden, oft deutlich schneller. Geeignet ist das für Massenaufgaben wie Produkttexte, Übersetzungen oder Auswertungen. Caching und Batch lassen sich kombinieren; was das in Ihrem Fall spart, rechnet der Spar-Rechner.

Welches Modell für welche Aufgabe

  • Haiku: Klassifizieren, Daten auslesen, kurze Antworten, Vorfilter in mehrstufigen Abläufen
  • Sonnet: Texte, Code, Kundenservice, Agenten im Alltag
  • Opus: schwierige Analysen, lange Codeänderungen, Aufgaben mit vielen Schritten

Ein häufiges Muster: Sonnet als Standard, Opus nur für die schwierigen Fälle. Den Kostenunterschied für Ihr Volumen zeigt der KI-Kostenrechner.

Abrechnung

Anthropic rechnet in US-Dollar ab, meist über ein vorab aufgeladenes Guthaben in der Console. Dort lassen sich Verbrauch je Arbeitsbereich verfolgen und Ausgabengrenzen setzen. Das ist ein anderes Modell als das Abo Claude Pro für die Chat-Oberfläche; welches sich lohnt, zeigt Abo oder API.

Häufige Fehler bei der Kalkulation

  • Preise je Million Tokens direkt mit OpenAI vergleichen, ohne die höhere Tokenzahl bei deutschen Texten zu berücksichtigen.
  • Den Aufschlag für das Schreiben in den Cache vergessen, wenn ein Prompt nur selten wiederverwendet wird.
  • Extended Thinking eingeschaltet lassen, obwohl die Aufgabe kein Nachdenken braucht. Denk-Tokens zählen als Ausgabe.
  • Für jede Anfrage Opus nutzen, obwohl Sonnet oder Haiku die meisten Fälle genauso gut lösen.

Erstellt mit Unterstützung von KI, geprüft und redaktionell verantwortet von Leon Blatz. Allgemeine Information, keine Rechts-, Steuer- oder Finanzberatung.

KostenrechnerMonatskosten für alle Modelle aus Tokenmengen und Anfragen, mit Caching, Batch und Teilen-Link.
Öffnen

Auch hilfreich: Systemprompt-Kostenrechner · KI-Preiskalkulation

KI-News

Aktuelle News zum Thema

Alle Anthropic & Claude-News
  1. Anhörung in New York: KI-Firmen geben keine Garantie für sichere Agenten6. Oktober 2026 · Sicherheit
  2. US-Verteidigungsministerium nutzt Claude nach eigenen Angaben nicht mehr5. Oktober 2026 · Politik
  3. DeepSeek V4.1 Flash: Abstand zu US-Modellen schrumpft auf 3 Prozent5. Oktober 2026 · Modelle
Weiterlesen

Weitere Artikel

  1. Gemini-API-Kosten verstehen: Pro, Flash und Flash-LiteGemini-API-Kosten verstehen: Preise von Gemini Pro, Flash und Flash-Lite, Aufschlag bei langen Eingaben, kostenlose Stufe und Batch-Rabatt verständlich erklärt.
  2. DeepSeek-API-Kosten: Günstige Preise und was dahinterstecktDeepSeek-API-Kosten: was DeepSeek V4 Pro und DeepSeek Flash je Million Tokens kosten, wie der Nachtrabatt funktioniert und was beim Datenschutz zu beachten ist.
  3. Mistral-API-Kosten: Was der europäische Anbieter kostetMistral-API-Kosten im Überblick: Preise von Mistral Large und Embeddings, Batch-Rabatt, Vorteile eines europäischen Anbieters und wann sich Mistral rechnet.