Un modèle basé sur le CPU servira des prédictions en temps réel avec un trafic intermittent pendant les heures ouvrables et des périodes d'inactivité en dehors de ces heures. Quelle option d'hébergement SageMaker est la plus rentable pour ce modèle de trafic ?
Choisissez une réponse
Appuyez sur une option pour vérifier votre réponse.
Bonne réponse : Déployer le modèle sur un point de terminaison SageMaker Serverless Inference. Configurer une concurrence provisionnée accrue pendant les heures ouvrables..
Pourquoi c'est la réponse
L'inférence sans serveur SageMaker est la plus rentable pour ce scénario car elle ne facture que la durée de traitement et la quantité de données traitées, ce qui est idéal pour les charges de travail intermittentes avec des périodes d'inactivité. La concurrence provisionnée garantit une faible latence pendant les heures de pointe. Déployer sur un point de terminaison SageMaker en temps réel avec une mise à l'échelle automatique basée sur un calendrier est moins rentable car les instances sont toujours en cours d'exécution et facturées même pendant les périodes de faible trafic, et la mise à l'échelle à zéro n'est pas une option native pour les points de terminaison en temps réel. L'inférence asynchrone SageMaker est conçue pour les charges de travail par lots ou les requêtes avec des charges utiles volumineuses et des temps de traitement longs, et non pour les prédictions en temps réel. Créer une fonction Lambda pour activer/désactiver un point de terminaison en temps réel est une solution complexe et moins efficace que l'inférence sans serveur, car elle implique des temps de démarrage à froid et une gestion manuelle.
Réussissez votre examen — sans la chasse aux réponses interminable
Obtenez toutes les questions et explications vérifiées pour cet examen en un seul endroit, et économisez des heures de préparation. Plus de 1 000 certifications · Plus de 20 langues · Gratuit pour commencer.
Réussissez votre examen plus rapidement → Pas de carte requise