MediCare AI quiere implementar una nueva versión de modelo en producción utilizando una estrategia azul/verde con un tiempo de inactividad mínimo y una reversión automática si la nueva variante produce una tasa elevada de errores 5xx. ¿Qué enfoque proporciona un cambio de tráfico controlado y un mecanismo de reversión automática dentro de las capacidades de AWS SageMaker?
Elige una respuesta
Toca una opción para verificar tu respuesta.
Respuesta correcta: Cree un nuevo EndpointConfig con dos ProductionVariants (azul = modelo actual, verde = modelo nuevo) configurando los pesos iniciales de ProductionVariant en azul:100, verde:0. Use una máquina de estado de Step Functions o una Lambda de implementación para llamar a UpdateEndpointWeightsAndCapacities (o UpdateEndpoint con el nuevo EndpointConfig) para cambiar incrementalmente los pesos hacia el verde. Cree una alarma de CloudWatch en la métrica de error 5xx del endpoint y conecte una regla de EventBridge para activar una Lambda de reversión que llame a UpdateEndpointWeightsAndCapacities para restablecer los pesos a azul si se supera el umbral de la alarma..
Por qué esta es la respuesta
La opción correcta describe una estrategia de implementación azul/verde robusta en SageMaker. Al crear un nuevo EndpointConfig con dos variantes (azul para el modelo actual y verde para el nuevo modelo) y establecer pesos iniciales de 100:0, se asegura que todo el tráfico vaya al modelo existente. El cambio gradual del tráfico se logra actualizando los pesos de las variantes, ya sea mediante UpdateEndpointWeightsAndCapacities o UpdateEndpoint con un nuevo EndpointConfig, orquestado por Step Functions o Lambda. La reversión automática se implementa con una alarma de CloudWatch en errores 5xx, que activa una Lambda a través de EventBridge para restablecer los pesos al modelo azul si se excede el umbral. Las otras opciones son incorrectas porque: Lanzar un endpoint de staging separado con ALB no es una capacidad nativa de SageMaker para implementaciones azul/verde de modelos, y agrega complejidad innecesaria. La función de implementación automática de Model Registry no tiene una estrategia de implementación 'BlueGreen' integrada con reversión automática basada en errorThreshold de esta manera. Llamar directamente a CreateEndpoint después de anular el registro del modelo antiguo causaría tiempo de inactividad, y la reversión manual con Lambda para recrear el endpoint anterior no es una estrategia azul/verde sin tiempo de inactividad.
Aprueba tu examen — sin la interminable búsqueda de respuestas
Obtén todas las preguntas y explicaciones verificadas para este examen en un solo lugar, y ahorra horas de preparación. Más de 1,000 certificaciones · Más de 20 idiomas · Empieza gratis.
Aprueba tu examen más rápido → No se requiere tarjeta