Skip to content

Calculadora de latencia de inferencia

Estima el tiempo de respuesta de extremo a extremo de una generación en streaming de un LLM a partir del tiempo hasta el primer token, el tiempo por token de salida y el número de tokens de salida.

Datos de entrada

Perfil de servicio

≥ 1

Resultados

Introduce un valor para ver los resultados.

Detalles

Insertar esta calculadora

Vista previa

Pega este código en tu página para mostrar la calculadora.

Compartir este cálculo

Quien abra este enlace verá tus valores ya rellenados.

200+ calculadoras · 10 idiomas · 100 % gratis

¿Te ha resultado útil esta calculadora?

No

¿Cómo podríamos mejorar esta calculadora?