Skip to content

Calculadora de VRAM para inferencia de LLM

Estima la VRAM de GPU necesaria para servir un modelo de lenguaje grande en inferencia a partir de su número de parámetros, la precisión de los pesos y la sobrecarga en tiempo de ejecución de la caché KV, las activaciones y la fragmentación.

Datos de entrada

Modelo

Tiempo de ejecución

%
0 – 200 %

Resultados

Introduce un valor para ver los resultados.

Detalles

Insertar esta calculadora

Vista previa

Pega este código en tu página para mostrar la calculadora.

Compartir este cálculo

Quien abra este enlace verá tus valores ya rellenados.

200+ calculadoras · 10 idiomas · 100 % gratis

¿Te ha resultado útil esta calculadora?

No

¿Cómo podríamos mejorar esta calculadora?