Token-Kosten-Rechner
Eingaben
| Eingabe-Token | 1.500 |
|---|---|
| Ausgabe-Token | 500 |
| Eingabepreis (je 1 Mio. Token) | 3 $ |
| Ausgabepreis (je 1 Mio. Token) | 15 $ |
Token-Kosten-Rechner
Berechnet die Kosten eines einzelnen API-Aufrufs an ein großes Sprachmodell (LLM) aus der Anzahl der Eingabe- und Ausgabe-Token sowie den Preisen des Modells je Million Token, wobei Eingabe und Ausgabe getrennt abgerechnet werden.
Eingaben
Token
Preise
Ergebnisse
Geben Sie einen Wert ein, um die Ergebnisse zu sehen.
Details
Token-Kosten erklärt
Die Token-Kosten eines API-Aufrufs an ein großes Sprachmodell (LLM) sind der Preis, der für eine einzelne Anfrage berechnet wird. Er ergibt sich aus der Zahl der an das Modell gesendeten und der von ihm zurückgegebenen Token sowie den veröffentlichten Sätzen des Modells je Token. Anbieter messen die Nutzung in Token — kurzen Textabschnitten, im Englischen jeweils etwa vier Zeichen — und rechnen die Eingabe (Prompt) und die Ausgabe (Antwort) getrennt ab, da beide zu unterschiedlichen Sätzen berechnet werden.
Wie Preise angegeben werden
Ein einzelnes Token kostet einen winzigen Bruchteil einer Währungseinheit, weshalb Anbieter die Sätze je eine Million Token angeben, um die ausgewiesene Zahl lesbar zu halten. Ein Satz von $3 je Million Eingabe-Token bedeutet, dass jedes Eingabe-Token drei Millionstel eines Dollar kostet; ein Ausgabesatz von $15 je Million ist das Fünffache. Die Ausgabe ist die teurere Seite, weil die Generierung Token für Token erfolgt und jedes einen vollständigen Durchlauf durch das Modell erfordert, während die Eingabe in einem einzigen parallelen Durchlauf verarbeitet wird.
Die Formel
Bei Eingabe-Token zum Preis je Million und Ausgabe-Token zum Preis je Million lauten die beiden abgerechneten Bestandteile
Cin=106ninpin,Cout=106noutpoutund die Kosten des Aufrufs sind ihre Summe:
C=Cin+CoutDie Division durch überführt die Angabe je Million in einen Satz je Token, bevor mit den Token-Anzahlen multipliziert wird.
Rechenbeispiel
Betrachtet sei eine Anfrage mit Eingabe-Token und Ausgabe-Token gegen ein Spitzenmodell der mittleren Klasse zu $3 je Million Eingabe und $15 je Million Ausgabe. Der Eingabeanteil beträgt
Cin=1061500×3=$0.0045und der Ausgabeanteil
Cout=106500×15=$0.0075was einen Gesamtbetrag von C = 0.0045 + 0.0075 = \0.012$ für den Aufruf ergibt. Obwohl der Prompt dreimal länger ist als die Antwort, tragen beide Hälften ungefähr gleich zur Rechnung bei, da der Ausgabesatz das Fünffache des Eingabesatzes beträgt. Das ist das prägende Merkmal der Token-Preisbildung: eine kurze Antwort zu einem hohen Satz kann ebenso viel kosten wie ein langer Prompt zu einem niedrigen Satz.
Anmerkungen und Varianten
Das Modell setzt einen gleichbleibenden Satz je Token voraus. In der Praxis kann der effektive Satz unter dem ausgewiesenen Wert liegen: Prompt-Caching verwendet wiederkehrenden Kontext zu einem Rabatt erneut, und asynchrone Stapelverarbeitung tauscht Latenz gegen einen niedrigeren Satz. Die Token-Anzahl hängt zudem vom Tokenizer und vom Inhalt ab — Programmcode und nicht-englische Schriftsysteme werden weniger effizient zerlegt und erzeugen mehr Token je Zeichen.
Anwendung
Die Kosten je Aufruf sind die atomare Einheit, aus der größere Schätzungen aufgebaut werden. Multipliziert mit dem Anfragevolumen ergeben sie die laufenden Ausgaben, das Thema des Rechner für monatliche LLM-Kosten, während ein agentenbasierter Arbeitsablauf, der viele Aufrufe je Aufgabe auslöst, vom Rechner für Agentenkosten behandelt wird. Um in die umgekehrte Richtung zu rechnen — wie viele Token ein festes Budget kauft — siehe Rechner für Token pro Geldeinheit.
Häufig gestellte Fragen (FAQ)
Warum werden Eingabe- und Ausgabe-Token unterschiedlich bepreist?
Das Lesen der Eingabeaufforderung und das Erzeugen der Antwort sind unterschiedliche Arbeitslasten. Eingabe-Token werden in einem einzigen parallelen Vorwärtsdurchlauf verarbeitet, während Ausgabe-Token nacheinander erzeugt werden, wobei jedes einen vollständigen Durchlauf durch das Modell erfordert.
Die Generierung ist daher rechenintensiver, weshalb Anbieter Ausgabe-Token höher bepreisen — üblicherweise beim Drei- bis Fünffachen des Eingabesatzes.
Wie vielen Token entspricht mein Text?
Ein Token ist ein Textabschnitt — im Englischen oft ein Wortfragment von drei bis vier Zeichen. Als grobe Faustregel entspricht ein Token etwa 0,75 englischen Wörtern, sodass 1.000 Token ungefähr 750 Wörtern entsprechen. Programmcode, Interpunktion und nicht-englische Schriftsysteme werden weniger effizient zerlegt und erzeugen mehr Token je Zeichen. Für eine genaue Zählung ist ein Tokenizer des Anbieters zu verwenden.
Warum werden Preise je Million Token angegeben?
Ein einzelnes Token kostet einen winzigen Bruchteil eines Cents, sodass ein Preis je Token eine unleserliche Folge von Nullen wäre. Die Angabe je Million Token hält die Kennzahl lesbar — ein Satz von drei je Million bedeutet, dass jedes Token drei Millionstel der Währungseinheit kostet.
Haftungsausschluss
Die Token-Anzahl hängt vom Tokenizer des Modells ab und variiert je nach Sprache und Inhalt. Veröffentlichte Preise ändern sich im Laufe der Zeit und schließen Rabatte für Caching oder Stapelverarbeitung möglicherweise aus. Aktuelle Sätze und genaue Token-Anzahlen sollten beim Anbieter überprüft werden, bevor eine Zahl für die Abrechnung herangezogen wird.