Calcolatore del risparmio con la cache dei prompt
Dati di input
| Token di input totali | 10.000 |
|---|---|
| Quota in cache | 70 % |
| Prezzo dell'input (per 1M di token) | 3 $ |
| Sconto cache | 90 % |
Calcolatore del risparmio con la cache dei prompt
Dati di input
Carico di lavoro
%
0 – 100 %
Prezzi
$
%
0 – 100 %
Risultati
Inserisci un valore per visualizzare i risultati.
$
Dettagli
$
$
%
Da provare dopo
Calcolatore del costo dei token
Calcola il costo di una singola chiamata API a un modello linguistico di grandi dimensioni (LLM) a partire dal numero di token di input e di output e dai prezzi per milione di token del modello, con input e output fatturati separatamente.
Calcolatore del risparmio con le API batch
Stima la riduzione di costo ottenuta eseguendo un carico di lavoro su un modello linguistico di grandi dimensioni (LLM) tramite un'API batch asincrona anziché l'endpoint in tempo reale, dove uno sconto fisso viene applicato all'intera fattura in cambio di una consegna differita.