Um modelo implantado em um endpoint serverless do SageMaker apresenta maior latência em produção do que nos testes. O engenheiro suspeita que a latência extra seja causada pelo tempo de inicialização do modelo. O que ele deve verificar para confirmar isso?
Escolha uma resposta
Toque em uma opção para verificar sua resposta.
Resposta correta: Habilitar as métricas do Amazon CloudWatch e inspecionar a métrica ModelSetupTime no namespace SageMaker..
Por que esta é a resposta
A opção correta é habilitar as métricas do Amazon CloudWatch e inspecionar a métrica ModelSetupTime no namespace SageMaker. Esta métrica mede o tempo que o SageMaker leva para configurar o ambiente e carregar o modelo antes que ele possa processar as invocações. Uma latência maior em produção, especialmente se for devido ao tempo de inicialização, será refletida nesta métrica. As outras opções estão incorretas porque: Agendar um trabalho do SageMaker Model Monitor e revisar as métricas de qualidade do modelo: O Model Monitor foca na qualidade dos dados e nas previsões do modelo, não no tempo de inicialização ou na latência de infraestrutura. Agendar um trabalho do SageMaker Model Monitor com as métricas do Amazon CloudWatch habilitadas: Embora o CloudWatch seja relevante, o Model Monitor em si não é a ferramenta primária para diagnosticar o tempo de inicialização do modelo. Habilitar as métricas do Amazon CloudWatch e inspecionar a métrica ModelLoadingWaitTime no namespace SageMaker: Não existe uma métrica padrão do SageMaker chamada ModelLoadingWaitTime que diretamente meça o tempo de carregamento do modelo da forma como ModelSetupTime o faz para o tempo de inicialização.
Passe no seu exame — sem a busca interminável por respostas
Obtenha todas as perguntas e explicações verificadas para este exame em um só lugar e economize horas de preparação. Mais de 1.000 certificações · Mais de 20 idiomas · Grátis para começar.
Passe no seu exame mais rápido → Não é necessário cartão