Cargas de trabalho de IA
Inferência
Executar um modelo treinado para produzir respostas ou previsões para os usuários.
Por que isso importa
A inferência costuma ser limitada pela memória e pela latência, e não pela capacidade computacional bruta, e roda continuamente quando há usuários.
Termos relacionados
Quer uma resposta mais aprofundada?
Peça à Kova para explicar Inferência no contexto da sua carga de trabalho. Conheça a Kova →
