Rechner für Einsparungen durch Prompt-Caching
Eingaben
| Eingabe-Token insgesamt | 10.000 |
|---|---|
| Zwischengespeicherter Anteil | 70 % |
| Eingabepreis (je 1 Mio. Token) | 3 $ |
| Cache-Rabatt | 90 % |
Rechner für Einsparungen durch Prompt-Caching
Eingaben
Arbeitslast
%
0 – 100 %
Preis
$
%
0 – 100 %
Ergebnisse
Geben Sie einen Wert ein, um die Ergebnisse zu sehen.
$
Details
$
$
%
Weitere Empfehlungen
Token-Kosten-Rechner
Berechnet die Kosten eines einzelnen API-Aufrufs an ein großes Sprachmodell (LLM) aus der Anzahl der Eingabe- und Ausgabe-Token sowie den Preisen des Modells je Million Token, wobei Eingabe und Ausgabe getrennt abgerechnet werden.
Rechner für Einsparungen durch die Batch-API
Schätzt die Kostensenkung, wenn eine LLM-Arbeitslast über eine asynchrone Batch-API statt über den Echtzeit-Endpunkt verarbeitet wird, wobei im Gegenzug für eine verzögerte Auslieferung ein einheitlicher Rabatt auf die gesamte Rechnung angewendet wird.