Un modelo debe ejecutarse una vez por noche para predecir los valores de las acciones del día siguiente. La entrada es de 3 MB recopilados ese día y la inferencia se completa en menos de 1 minuto. ¿Cómo debería implementar este modelo en Amazon SageMaker para cumplir con estos requisitos?
Elige una respuesta
Toca una opción para verificar tu respuesta.
Respuesta correcta: Utilice un endpoint de inferencia serverless y establezca MaxConcurrency en 1..
Por qué esta es la respuesta
La inferencia serverless de Amazon SageMaker es la opción más adecuada porque está diseñada para cargas de trabajo intermitentes o infrecuentes, como una ejecución diaria. Se escala automáticamente a cero cuando no está en uso, eliminando costos de infraestructura o administración de instancias. Establecer MaxConcurrency en 1 garantiza que solo se procese una solicitud a la vez, lo cual es apropiado para una tarea nocturna única. Un endpoint serverless de múltiples modelos no es necesario, ya que solo se menciona un modelo. La inferencia asíncrona es para cargas de trabajo con payloads grandes o tiempos de procesamiento largos, no para una inferencia rápida de 3 MB. Un endpoint en tiempo real, incluso con autoescalado a cero, incurre en costos por el tiempo de inicio de la instancia y no es tan eficiente en costos para una ejecución diaria como la inferencia serverless.
Aprueba tu examen — sin la interminable búsqueda de respuestas
Obtén todas las preguntas y explicaciones verificadas para este examen en un solo lugar, y ahorra horas de preparación. Más de 1,000 certificaciones · Más de 20 idiomas · Empieza gratis.
Aprueba tu examen más rápido → No se requiere tarjeta