Um modelo baseado em CPU fornecerá previsões em tempo real com tráfego intermitente durante o horário comercial e períodos ociosos fora do horário comercial. Qual opção de hospedagem do SageMaker é a mais econômica para esse padrão?
Escolha uma resposta
Toque em uma opção para verificar sua resposta.
Resposta correta: Implante o modelo em um endpoint SageMaker Serverless Inference. Configure o aumento da simultaneidade provisionada durante o horário comercial..
Por que esta é a resposta
A inferência sem servidor do SageMaker (SageMaker Serverless Inference) é a opção mais econômica para tráfego intermitente e períodos ociosos, pois você paga apenas pela capacidade de computação usada para processar solicitações de inferência, e não por instâncias ociosas. A simultaneidade provisionada garante que o modelo esteja pronto para responder rapidamente durante os picos de tráfego no horário comercial, sem incorrer em custos de instâncias ociosas fora desse período. A implantação em um endpoint em tempo real com auto scaling baseado em agendamento (opção 1) ainda incorreria em custos para instâncias mínimas mesmo durante períodos ociosos. A inferência assíncrona (opção 3) não é adequada para previsões em tempo real. Ativar e desativar um endpoint em tempo real com uma função Lambda (opção 4) introduziria latência significativa para o "cold start" e não é a forma ideal de gerenciar custos para este padrão.
Passe no seu exame — sem a busca interminável por respostas
Obtenha todas as perguntas e explicações verificadas para este exame em um só lugar e economize horas de preparação. Mais de 1.000 certificações · Mais de 20 idiomas · Grátis para começar.
Passe no seu exame mais rápido → Não é necessário cartão