AI & LLM
Calculators for LLM cost, inference, training, and model infrastructure.
Cost & Pricing
26Calcul d’amortissement de prompt systèmeCalcul du coût de génération d'imagesCalcul du coût de synthèse vocaleCalcul du coût de transcription audioCalcul du surcoût des sorties structuréesCalcul du surcoût en tokens des appels de fonctionCalculateur d'économies de l'API par lotsCalculateur d'économies du cache d'inviteCalculateur de coût d'embeddingsCalculateur de coût d'un agentCalculateur de coût d'une base de données vectorielleCalculateur de coût d'utilisation de GPUCalculateur de coût en jetonsCalculateur de coût énergétique de l'inférenceCalculateur de coût GPU cloudCalculateur de coût mensuel d'un LLMCalculateur de croissance du coût de contexteCalculateur de jetons en motsCalculateur de jetons par unité monétaireCalculateur de planification des limites de débit d'un LLMCalculateur de taille de base de données vectorielleCalculateur de tenue dans la fenêtre de contexteCalculateur du seuil de rentabilité auto-hébergement contre APICoût d'un réglage fin de modèleEmpreinte carbone d'un entraînementTemps et coût d'entraînement
Inference & Serving
8Calculateur d'accélération par décodage spéculatifCalculateur d'utilisation des FLOP du modèle (MFU)Calculateur de débit d'inférenceCalculateur de débit d'inférence par lotsCalculateur de FLOP par jetonCalculateur de jetons effectifs par secondeCalculateur de latence d'inférenceCalculateur de tokens d'image multimodale
Training & Scaling
12Bulle du parallélisme de pipelineCalcul des FLOP d'entraînementCalculateur de mémoire pour l'accumulation de gradientCalculateur de paramètres LoRACalculateur de VRAM pour l'entraînement de LLMÉchauffement du taux d'apprentissageÉpoques tenant dans un budget de calculMise à l'échelle en parallélisme de donnéesNombre de jetons d'un jeu de donnéesTaille de lot effectiveTaille de modèle optimale en calculTokens optimaux selon Chinchilla
Hardware & Memory
8Calculateur de mémoire d'attentionCalculateur de paramètres actifs MoECalculateur de taille de modèle selon la quantificationCalculateur de taille du cache KVCalculateur de temps de téléchargement de modèleCalculateur de VRAM pour l'inférence LLMCalculateur du nombre de GPU pour un modèleCalculateur du nombre de paramètres d'un transformeur