Format-Vergleich: JSON oder CSV?
JSON oder CSV, YAML oder Markdown: Welches Datenformat kostet die wenigsten Tokens? JSON einfügen und den Unterschied für Ihre Daten sehen.
Fügen Sie JSON ein oder laden Sie das Beispiel.
| Format | Tokens | ggü. JSON formatiert | je 1.000 Anfragen |
|---|
Warum das Format Geld kostet
Dieselben Daten werden in mehrere Formate umgewandelt und mit dem GPT-Tokenizer gezählt. Formatiertes JSON wiederholt bei jedem Eintrag alle Feldnamen und enthält viel Leerraum; CSV und Markdown-Tabellen nennen die Spalten nur einmal und sind bei Listen gleichartiger Einträge oft 40 bis 60 Prozent kürzer.
Welches Format das Modell am besten versteht, hängt von der Aufgabe ab. Für reine Tabellen funktionieren CSV und Markdown sehr gut; verschachtelte Daten bleiben besser JSON oder YAML. Klicken Sie eine Zeile an, um die Umwandlung zu sehen und zu kopieren.
Häufige Fragen
Welches Format spart die meisten Tokens?
Bei Listen gleichartiger Einträge meist CSV, dicht gefolgt von Markdown-Tabellen. Kompaktes JSON ohne Leerraum spart gegenüber formatiertem JSON oft schon 20 bis 30 Prozent.
Versteht das Modell CSV genauso gut wie JSON?
Für tabellarische Daten in der Regel ja. Bei verschachtelten Strukturen oder wenn das Modell selbst strukturierte Daten zurückgeben soll, ist JSON eindeutiger.
Lohnt sich die Umstellung?
Bei einzelnen Anfragen kaum. Wenn dieselben Daten aber tausendfach in Prompts stehen, etwa Produktkataloge im Kundenservice, summiert sich die Ersparnis schnell auf viele Euro im Monat.
Kann ich JSON zu CSV umwandeln?
Ja. Das Werkzeug wandelt JSON zu CSV, JSON zu YAML, in XML und in eine Markdown-Tabelle um. Klicken Sie eine Zeile an und kopieren Sie das Ergebnis.
Wie kann ich mit dem Datenformat Tokens sparen?
Bei Listen gleichartiger Einträge spart CSV oft über die Hälfte, weil die Feldnamen nur einmal vorkommen. Schon kompaktes JSON ohne Leerzeichen bringt 20 bis 40 Prozent. So lassen sich Tokens sparen, ohne dass Information verloren geht.
Zum Weiterlesen
- Was sind Tokens? Einfach erklärtTokens sind die Rechen- und Abrechnungseinheit von Sprachmodellen. Was ein Token ist, wie viele ein deutscher Text hat und warum das Geld kostet.
- Kontextfenster erklärt: Wie viel Text ein Modell auf einmal verarbeitetDas Kontextfenster begrenzt, wie viel ein KI-Modell gleichzeitig lesen und schreiben kann. Was die Zahl bedeutet, wo die Grenzen liegen und wie man damit umgeht.
- Warum deutsche Texte mehr Tokens brauchen als englischeDeutsche Texte brauchen meist 20 bis 50 Prozent mehr Tokens als englische. Woran das liegt, was es kostet und was man dagegen tun kann.
Das könnte auch helfen
Antwortzeit-Rechnerneu
Wie lange dauert eine KI-Antwort? Wartezeit aus Antwortlänge, Geschwindigkeit und Nachdenken.
Öffnenmax_tokens-Rechnerneu
Welches max_tokens für 500 Wörter? Ausgabelimit passend zur gewünschten Antwortlänge setzen.
ÖffnenTemperatur-Simulator
Sehen, wie Temperatur, Top-p und Top-k die Wortwahl eines Sprachmodells verändern.
ÖffnenModell-Finder
Welches KI-Modell passt? Aufgabe, Kontext und Budget angeben, passende Modelle nach Preis erhalten.
ÖffnenToken-Zähler
Tokens eines Textes oder einer Datei (PDF, Word, TXT) zählen, mit Kosten für alle Modelle.
ÖffnenKontextfenster-Rechner
Passt mein Dokument ins Kontextfenster? Seiten oder Wörter eingeben, für alle Modelle prüfen.
Öffnen