Uma empresa pretende usar um modelo de IA generativa para fornecer aos usuários cotações de serviço em tempo real. Qual critério de seleção é o mais importante para esta aplicação?
Escolha uma resposta
Toque em uma opção para verificar sua resposta.
Resposta correta: Baixa latência e desempenho de inferência otimizado para respostas rápidas.
Por que esta é a resposta
Para fornecer cotações de serviço em tempo real, a capacidade de gerar respostas rapidamente é crucial. Baixa latência e desempenho de inferência otimizado garantem que o modelo possa processar solicitações e retornar cotações sem atrasos perceptíveis para o usuário, o que é fundamental para uma boa experiência e para a utilidade da aplicação em tempo real. O tamanho geral do modelo é menos importante do que a velocidade de resposta; um modelo grande pode ser lento. A qualidade dos dados de treinamento é sempre importante, mas mesmo com dados excelentes, um modelo lento não atenderá ao requisito de tempo real. Escolher um modelo de uso geral e ter acesso a GPUs de alta potência pode ajudar na inferência, mas a otimização específica para baixa latência é o critério mais direto e importante para este caso de uso.
Passe no seu exame — sem a busca interminável por respostas
Obtenha todas as perguntas e explicações verificadas para este exame em um só lugar e economize horas de preparação. Mais de 1.000 certificações · Mais de 20 idiomas · Grátis para começar.
Passe no seu exame mais rápido → Não é necessário cartão