Cargas de trabajo de IA
Inferencia
Ejecutar un modelo entrenado para generar respuestas o predicciones para los usuarios.
Por qué importa
La inferencia suele estar limitada por la memoria y la latencia más que por la capacidad de cómputo bruta, y se ejecuta de forma continua una vez que tienes usuarios.
Términos relacionados
¿Quieres una respuesta más detallada?
Pide a Kova que explique Inferencia en el contexto de tu carga de trabajo. Conoce a Kova →
