Una empresa implementará un modelo para inferencia de producción en un endpoint de SageMaker. Las cargas útiles típicas de las solicitudes están entre 100 MB y 300 MB, y cada solicitud debe completarse en 60 minutos. ¿Qué opción de inferencia de SageMaker se debe utilizar?
Elige una respuesta
Toca una opción para verificar tu respuesta.
Respuesta correcta: Asynchronous inference.
Por qué esta es la respuesta
La inferencia asíncrona es la opción correcta porque está diseñada para manejar cargas útiles de solicitud grandes (hasta 1 GB) y tiempos de procesamiento prolongados (hasta 1 hora), lo que se alinea perfectamente con los requisitos de 100-300 MB y 60 minutos. La inferencia sin servidor no es adecuada para cargas útiles tan grandes. La inferencia en tiempo real tiene límites más estrictos en el tamaño de la carga útil y el tiempo de respuesta, lo que la hace inviable para este caso. La transformación por lotes es para procesar un conjunto de datos completo a la vez, no para solicitudes individuales de un endpoint.
Aprueba tu examen — sin la interminable búsqueda de respuestas
Obtén todas las preguntas y explicaciones verificadas para este examen en un solo lugar, y ahorra horas de preparación. Más de 1,000 certificaciones · Más de 20 idiomas · Empieza gratis.
Aprueba tu examen más rápido → No se requiere tarjeta