GPU-Kosten-Rechner für Training und Inferenz
Der GPU-Kosten-Rechner zeigt Trainingskosten und Inferenz-Kosten aus GPU-Stunden und Stundensatz und schätzt die Trainingsdauer aus Parametern, Tokens und FLOPs.
| Posten | Wert |
|---|
Mit „Beispielwert“ markierte Preise sind nur Platzhalter: Tragen Sie die aktuellen Preise Ihres Anbieters ein. Modellpreise stammen aus unserer Modellübersicht (US-Dollar-Listenpreise, umgerechnet in Euro).
Alles läuft in Ihrem Browser. Eingaben verlassen Ihr Gerät nicht.
Von GPU-Stunden zu Euro
Der GPU-Kosten-Rechner multipliziert GPU-Stunden mit dem Stundensatz Ihres Anbieters. Bei Cloud-GPU-Anbietern zahlen Sie für jede angefangene oder volle Stunde, die eine GPU reserviert ist, unabhängig davon, ob sie rechnet. Für Trainingskosten zählt deshalb die gesamte Laufzeit inklusive Einrichtung, Fehlversuchen und Wartezeit, für Inferenz die Zeit, die der Server bereitsteht.
Wie lange ein Training dauert, lässt sich mit der Faustformel 6 · N · D grob schätzen: N ist die Zahl der Parameter, D die Zahl der Trainings-Tokens. Ein Modell mit 7 Milliarden Parametern auf 140 Milliarden Tokens braucht rund 5,9 · 10^21 FLOPs. Geteilt durch die Rechenleistung der GPUs mal der realistischen Auslastung (MFU) ergibt sich die Laufzeit. Die TFLOPS stehen im Datenblatt der GPU, je nach Zahlenformat unterschiedlich; der voreingestellte Wert ist ein Beispielwert.
Für Inferenz im Dauerbetrieb wählen Sie Stunden pro Tag und Tage pro Monat; der Rechner zeigt dann die Monatskosten und eine Hochrechnung für zwölf Monate. Reservierte Instanzen und Spot-Angebote sind oft deutlich günstiger, Spot-Instanzen können aber jederzeit beendet werden. Nicht enthalten sind Datenvorbereitung, Personal und Speicher über die Zusatzkosten hinaus. Ob sich eigene GPUs gegenüber einer API überhaupt lohnen, zeigt der Rechner API oder selbst hosten.
Anleitung: GPU-Kosten-Rechner in 4 Schritten
- Unter „Berechnung“ wählen: Laufzeit direkt, Training aus FLOPs schätzen oder Dauerbetrieb für Inferenz.
- Anzahl GPUs und Preis je GPU-Stunde eintragen, optional Rabatt für Reservierung oder Spot.
- Je nach Modus Stunden, Parameter und Trainings-Tokens oder Stunden pro Tag angeben.
- Speicher und Datenverkehr ergänzen und die Gesamtkosten kopieren.
Typische Anwendungsfälle
- Ein Fine-Tuning oder kleines Vortraining auf gemieteten Cloud-GPUs budgetieren.
- Abschätzen, wie lange ein Trainingslauf bei gegebener GPU-Zahl dauert.
- Monatskosten für einen dauerhaft laufenden Inferenz-Server ermitteln.
- On-Demand-Preise mit reservierten Instanzen vergleichen.
Häufige Fragen
Was kostet eine GPU-Stunde?
Das hängt von GPU-Modell, Anbieter, Region und Vertragsart ab und reicht von unter einem bis zu mehreren US-Dollar je Stunde für aktuelle Rechenzentrums-GPUs. Tragen Sie den Preis Ihres Angebots ein.
Wie genau ist die Schätzung über FLOPs?
Sie gibt eine Größenordnung. Die tatsächliche Laufzeit hängt von Software, Kommunikation zwischen GPUs, Kontextlänge und Fehlversuchen ab. Planen Sie einen Aufschlag ein.
Brauche ich für Fine-Tuning eigene GPUs?
Nicht unbedingt. Viele Anbieter bieten Fine-Tuning als Dienst mit Abrechnung je Trainings-Token an; die Kosten dafür rechnet der Fine-Tuning-Kostenrechner.
Was bedeutet MFU?
Model FLOPs Utilization: der Anteil der theoretischen Rechenleistung, den ein Training tatsächlich nutzt. Kommunikation, Speicherzugriffe und Wartezeiten sorgen dafür, dass er deutlich unter 100 % liegt.
Warum 6 · N · D?
Das ist eine gängige Faustformel für Transformer: Pro Token und Parameter fallen beim Training etwa zwei Rechenoperationen im Vorwärts- und vier im Rückwärtsdurchlauf an. Sie gilt für dichte Modelle und vernachlässigt die Attention-Kosten bei langen Kontexten.
Zum Weiterlesen
- KI-API-Kosten senken: Zehn Stellschrauben, die wirklich etwas bringenKI-API-Kosten senken: Wer Sprachmodelle über die API nutzt, zahlt pro Token. Mit diesen zehn Maßnahmen sinkt die Rechnung oft um die Hälfte, ohne schlechtere Ergebnisse.
- ChatGPT API Kosten: Was die OpenAI-API wirklich kostetChatGPT API Kosten verständlich erklärt: Preise aller GPT-Modelle in Euro, Rechenbeispiele für typische Anwendungen und Tipps, wie die Rechnung klein bleibt.
- Claude vs. ChatGPT: Unterschiede bei Preis, Kontext und EinsatzClaude vs. ChatGPT im Vergleich: API-Preise in Euro, Kontextfenster, Tokenizer, Abos und typische Stärken. Sachlich, mit aktuellen Zahlen und Rechenbeispielen.
Das könnte auch helfen
Systemprompt-Kostenrechnerneu
Was kostet Ihr Systemprompt im Jahr? Mit und ohne Prompt-Caching, für alle Modelle.
ÖffnenKI-Preiskalkulationneu
Was muss Ihr KI-Produkt pro Nutzer kosten? KI-Kosten, Marge und Preis für ein SaaS-Angebot.
ÖffnenReasoning-Kostenrechnerneu
Was kostet das Nachdenken von Reasoning-Modellen? Denk-Tokens und Mehrkosten pro Anfrage.
ÖffnenBudget-Rechner
Wie viele Anfragen schaffe ich mit 50 € im Monat? Für alle 36 Modelle.
ÖffnenÜbersetzungskosten-Rechner
Was kostet eine Übersetzung mit KI im Vergleich zum Übersetzungsbüro? Pro Wort und Dokument.
ÖffnenRAG-Kostenrechner
Was kostet eine KI mit eigenen Dokumenten? Embeddings, Abfragen und Vektordatenbank berechnen.
Öffnen