A MediaWatch executa um modelo de classificação de vídeo em tempo real e deseja alertar quando o tempo de execução do modelo aumenta. Qual métrica do CloudWatch deve ser usada para detectar apenas o aumento do tempo de inferência do contêiner do modelo, e qual é a maneira recomendada de alarmar sobre aumentos sustentados para uma variante específica de um endpoint?
Escolha uma resposta
Toque em uma opção para verificar sua resposta.
Resposta correta: Use a métrica 'ModelLatency' do AWS/SageMaker com as dimensões EndpointName e VariantName (isso mede o tempo no contêiner do modelo). Crie um alarme do CloudWatch na estatística p90 (ou percentil desejado) para ModelLatency em um período de 5 minutos com períodos de avaliação definidos como 3 para detectar aumentos sustentados..
Por que esta é a resposta
A métrica ModelLatency do AWS/SageMaker, com as dimensões EndpointName e VariantName, mede o tempo que o contêiner do modelo leva para processar uma solicitação de inferência, sendo ideal para detectar o aumento do tempo de execução do modelo. Usar a estatística p90 (ou outro percentil alto) em um período de 5 minutos com 3 períodos de avaliação garante que o alarme seja acionado apenas por aumentos sustentados na latência, evitando falsos positivos por picos transitórios. OverheadLatency mede o tempo gasto fora do contêiner do modelo. InvocationDuration inclui o tempo de rede e roteamento, não apenas o tempo do modelo. Alarmar na métrica ModelLatency sem dimensões seria global, não específico para uma variante, e um alarme no mínimo detectaria diminuições, não aumentos.
Passe no seu exame — sem a busca interminável por respostas
Obtenha todas as perguntas e explicações verificadas para este exame em um só lugar e economize horas de preparação. Mais de 1.000 certificações · Mais de 20 idiomas · Grátis para começar.
Passe no seu exame mais rápido → Não é necessário cartão