Un modelo basado en CPU servirá predicciones en tiempo real con tráfico intermitente durante el horario comercial y períodos de inactividad fuera de este horario. ¿Qué opción de hosting de SageMaker es la más rentable para este patrón?
Elige una respuesta
Toca una opción para verificar tu respuesta.
Respuesta correcta: Implementar el modelo en un endpoint de SageMaker Serverless Inference. Configurar una mayor concurrencia provisionada durante el horario comercial..
Por qué esta es la respuesta
La inferencia sin servidor de SageMaker (Serverless Inference) es la opción más rentable para cargas de trabajo intermitentes porque escala automáticamente a cero cuando no hay tráfico, eliminando costos por recursos inactivos. La concurrencia provisionada permite precalentar instancias para manejar picos de tráfico esperados durante el horario comercial sin latencia. Un endpoint en tiempo real con auto scaling basado en programación no escala a cero y incurre en costos por instancias mínimas incluso fuera del horario. La inferencia asíncrona no es adecuada para predicciones en tiempo real. Activar un endpoint en tiempo real con Lambda es una solución compleja y menos eficiente que Serverless Inference para este patrón.
Aprueba tu examen — sin la interminable búsqueda de respuestas
Obtén todas las preguntas y explicaciones verificadas para este examen en un solo lugar, y ahorra horas de preparación. Más de 1,000 certificaciones · Más de 20 idiomas · Empieza gratis.
Aprueba tu examen más rápido → No se requiere tarjeta