Rechner für den Mehraufwand strukturierter Ausgaben
Eingaben
| Anzahl der Felder | 8 |
|---|---|
| Token pro Feld | 8 |
| Anzahl der Anfragen | 1.000 |
| Ausgabepreis (pro 1 Mio. Token) | 3 $ |
| Rahmen-Token | 4 |
Rechner für den Mehraufwand strukturierter Ausgaben
Schätzen Sie die zusätzlichen Ausgabe-Token und die Kosten, wenn ein LLM JSON gemäß einem Schema zurückgeben soll — die Feldnamen, Typmarkierungen und Satzzeichen, die die eigentlichen Werte umgeben.
Eingaben
Schema
Volumen und Preise
Rahmen-Token
Ergebnisse
Geben Sie einen Wert ein, um die Ergebnisse zu sehen.
Details
Mehraufwand strukturierter Ausgaben
Der Mehraufwand strukturierter Ausgaben ist der Anteil einer LLM-Antwort, der auf Formatierung statt auf Inhalt entfällt. Wenn ein Modell JSON gemäß einem Schema zurückgeben soll, muss es zusätzlich zu den eigentlichen Werten jeden Schlüsselnamen, jedes Anführungszeichen, jeden Doppelpunkt, jedes Komma und jede geschweifte Klammer ausgeben. Diese strukturellen Token werden genau wie jedes andere Ausgabe-Token erzeugt und abgerechnet, sodass eine Antwort, die wenige kurze Werte trägt, einen großen Teil ihrer Token auf das Gerüst verwenden kann. Dieser Rechner isoliert diesen festen Mehraufwand und die wiederkehrenden Kosten, die er über ein Anfragevolumen hinweg verursacht.
Woher der Mehraufwand kommt
Jedes Feld im zurückgegebenen Objekt steuert einen in Anführungszeichen
gesetzten Schlüssel bei, einen Doppelpunkt zur Trennung von Schlüssel und Wert
sowie ein Komma vor dem nächsten Feld. Ein Feld namens shipping_status zerfällt
in mehrere Token, bevor überhaupt ein Wert geschrieben wird. Zusätzlich zu den
Kosten pro Feld trägt jede Antwort einen festen Rahmen — die öffnende und
schließende geschweifte Klammer des Objekts und jegliches Schema-Gerüst, das der
Anbieter einfügt — der einmal gezählt wird, unabhängig davon, wie viele Felder
folgen. Da dieser Rahmen und die Struktur pro Feld nicht von den Werten abhängen,
ist der Mehraufwand für ein gegebenes Schema konstant und steigt linear mit der
Anzahl der Anfragen.
Formel
Mit Feldern zu je Gerüst-Token und Rahmen-Token beträgt der Mehraufwand pro Anfrage
tcall=f⋅tf+twÜber Anfragen ergeben sich die gesamte strukturelle Token-Zahl und ihre Kosten bei einem Ausgabepreis pro Million Token zu
TC=tcall⋅n=106TpDie Division durch wandelt den Preis pro Million in einen Satz pro Token um. Eine strukturierte Ausgabe wird vom Modell erzeugt, sodass der Mehraufwand zum Ausgabesatz abgerechnet wird, der üblicherweise der höhere der beiden veröffentlichten Preise ist.
Rechenbeispiel
Betrachten wir eine Extraktionsaufgabe, die einen Datensatz mit 12 Feldern zurückgibt, wobei jedes Feld etwa 9 Gerüst-Token kostet und der Objektrahmen 5 Rahmen-Token hinzufügt. Der Mehraufwand pro Anfrage beträgt
tcall=12×9+5=113 TokenÜber 40.000 Anfragen bei einem Ausgabepreis von 15 $ pro Million Token belaufen sich die strukturellen Kosten auf
TC=113×40000=4520000 Token=1064520000×15=67,80 $Diese 67,80 $ erkaufen keine Information — sie zahlen nur für die Klammern, Schlüssel und Kommata, die die extrahierten Werte umhüllen. Bei diesem Volumen schlägt sich das Kürzen von Schlüsselnamen oder das Weglassen ungenutzter Felder unmittelbar in einer wiederkehrenden Ersparnis nieder.
Hinweise und Varianten
Der Wert pro Feld ist ein Durchschnitt; lange, beschreibende Schlüsselnamen kosten mehr als knappe, und verschachtelte Objekte fügen ihre eigenen zwischenliegenden Klammern und Schlüssel hinzu. Das Modell gibt auch die Werte selbst aus, die dieser Rechner ausschließt — er misst nur die strukturelle Untergrenze, die ein Schema auferlegt. Wo dieselbe Aufgabe durch eine kompaktere Darstellung erfüllt werden kann, sinkt diese Untergrenze entsprechend.
Anwendung
Der Mehraufwand strukturierter Ausgaben fällt auf der Ausgabeseite der Rechnung an. Das eingabeseitige Gegenstück — die Tool-Definitionen, die mit jeder Function-Calling-Anfrage gesendet werden — behandelt der Token-Mehraufwand bei Function-Calling-Rechner. Um die zugrunde liegende Token-Nutzung pro Anfrage zu bepreisen, aus der dieser Mehraufwand abgeleitet wird, siehe den Token-Kosten-Rechner.
Häufig gestellte Fragen (FAQ)
Was ist eine strukturierte Ausgabe?
Eine strukturierte Ausgabe ist ein Modus, in dem das Modell darauf beschränkt wird, Daten in einer festen Form zurückzugeben — meist JSON gemäß einem vorgegebenen Schema — statt frei formulierter Prosa. Sie wird verwendet, wenn ein Programm die Antwort direkt verarbeitet, etwa beim Extrahieren von Feldern aus einem Dokument oder beim Zurückgeben eines typisierten Datensatzes.
Die Struktur ist für den verarbeitenden Code praktisch, besteht aber selbst aus Token: jeder Schlüsselname, jedes Anführungszeichen, jeder Doppelpunkt, jedes Komma und jede Klammer wird erzeugt und neben den Werten abgerechnet.
Wie lässt sich der Schema-Mehraufwand verringern?
Kürzere Schlüsselnamen kosten weniger Token, sodass ein kompakter Feldname den Wert pro Feld über alle Anfragen hinweg senkt. Wenn nur die Felder zurückgegeben werden, die ein nachgelagerter Schritt tatsächlich verwendet, zahlt man nicht für Daten, die niemand liest. Das Abflachen tief verschachtelter Objekte entfernt zwischenliegende Klammern und Schlüssel.
Da der Mehraufwand pro Antwort fest ist, fällt er am stärksten bei Anfragen mit hohem Volumen und kleiner Nutzlast ins Gewicht, bei denen die Struktur dem Inhalt im Umfang gleichkommen kann.
Kostet der JSON-Modus genauso viel wie Function Calling?
Beide verursachen Token-Mehraufwand, aber an unterschiedlichen Stellen. Der JSON- oder Strukturausgabe-Modus fügt der Antwort Token hinzu — dem Objekt, das das Modell zurückschreibt. Function Calling sendet zusätzlich die Tool-Definitionen bei jeder Anfrage in der Eingabe, sodass dessen Mehraufwand größtenteils auf der Eingabeseite anfällt.
Der Rechner für den Mehraufwand beim Function Calling behandelt diese eingabeseitigen Kosten; dieser Rechner behandelt die ausgabeseitigen Kosten des zurückgegebenen Objekts.
Haftungsausschluss
Die Token-Angaben sind Schätzungen, die vom Tokenizer des Modells, von den genauen Schlüsselnamen und davon abhängen, wie das Schema verschachtelt ist. Veröffentlichte Preise ändern sich im Laufe der Zeit und können Caching- oder Batch-Rabatte ausschließen. Prüfen Sie die aktuellen Sätze und genauen Token-Zahlen bei Ihrem Anbieter, bevor Sie sich für die Abrechnung auf einen Wert verlassen.