Adverto está evaluando SageMaker Serverless Inference frente a un endpoint en tiempo real siempre activo para un lote de modelos con tráfico muy irregular (muchos minutos sin solicitudes, ráfagas ocasionales). ¿Qué afirmación sobre el modelo de costos de Serverless Inference frente a un endpoint en tiempo real siempre activo es más precisa para minimizar el costo en esta carga de trabajo?
Elige una respuesta
Toca una opción para verificar tu respuesta.
Respuesta correcta: Serverless Inference se factura por invocación y duración de cómputo (GB-segundos); suele ser más económico para tráfico irregular y de bajo ciclo de trabajo en comparación con un endpoint en tiempo real siempre activo que se factura por hora de instancia incluso cuando está inactivo..
Por qué esta es la respuesta
La inferencia sin servidor (Serverless Inference) es ideal para cargas de trabajo con tráfico irregular porque solo se paga por las invocaciones y la duración del cómputo (GB-segundos) cuando el endpoint está activo. Un endpoint en tiempo real siempre activo (always-on real-time endpoint) se factura por hora de instancia, incluso cuando no recibe solicitudes, lo que lo hace más costoso para modelos con largos períodos de inactividad. La opción de tarifa mensual fija es incorrecta, ya que Serverless Inference no tiene una tarifa base fija. La afirmación de que los endpoints en tiempo real no incurren en cargos cuando están inactivos es falsa; se facturan por la instancia subyacente. Finalmente, aunque Serverless Inference comparte similitudes con Lambda, sus modelos de precios no son idénticos y no incluye un nivel gratuito de 1 millón de solicitudes.
Aprueba tu examen — sin la interminable búsqueda de respuestas
Obtén todas las preguntas y explicaciones verificadas para este examen en un solo lugar, y ahorra horas de preparación. Más de 1,000 certificaciones · Más de 20 idiomas · Empieza gratis.
Aprueba tu examen más rápido → No se requiere tarjeta