Uma empresa implantará um modelo para inferência de produção em um endpoint do SageMaker. Os payloads de solicitação típicos estão entre 100 MB e 300 MB, e cada solicitação deve ser concluída em 60 minutos. Qual opção de inferência do SageMaker deve ser usada?
Escolha uma resposta
Toque em uma opção para verificar sua resposta.
Resposta correta: Asynchronous inference.
Por que esta é a resposta
A inferência assíncrona é a melhor opção porque foi projetada para payloads de solicitação grandes e tempos de processamento longos, que se alinham com os requisitos de 100 MB a 300 MB e 60 minutos. A inferência em tempo real não é adequada devido aos grandes payloads e ao longo tempo de processamento, pois é otimizada para baixa latência e payloads pequenos. A inferência sem servidor pode ter limites de payload e tempo de execução que a tornam inadequada para esses requisitos. A transformação em lote é para processamento offline de grandes conjuntos de dados e não para inferência sob demanda em um endpoint.
Passe no seu exame — sem a busca interminável por respostas
Obtenha todas as perguntas e explicações verificadas para este exame em um só lugar e economize horas de preparação. Mais de 1.000 certificações · Mais de 20 idiomas · Grátis para começar.
Passe no seu exame mais rápido → Não é necessário cartão