Un modèle doit s'exécuter une fois par nuit pour prédire les valeurs boursières du lendemain. L'entrée est de 3 Mo de données collectées ce jour-là, et l'inférence se termine en moins d'une minute. Comment devriez-vous déployer ce modèle dans Amazon SageMaker pour répondre à ces exigences ?
Choisissez une réponse
Appuyez sur une option pour vérifier votre réponse.
Bonne réponse : Utiliser un point de terminaison d'inférence sans serveur et définir MaxConcurrency sur 1..
Pourquoi c'est la réponse
Un point de terminaison d'inférence sans serveur SageMaker est idéal pour les charges de travail intermittentes ou peu fréquentes, comme l'exécution nocturne décrite. Il se met à l'échelle automatiquement à zéro instance lorsqu'il n'est pas utilisé, ce qui minimise les coûts, et se met à l'échelle rapidement pour gérer les requêtes. Définir MaxConcurrency sur 1 garantit que le modèle ne traite qu'une seule inférence à la fois, ce qui est suffisant pour une tâche quotidienne unique. Les points de terminaison sans serveur multi-modèles sont conçus pour héberger plusieurs modèles sur la même instance, ce qui n'est pas nécessaire ici. Les points de terminaison d'inférence asynchrone sont pour les charges utiles volumineuses ou les inférences longues, ce qui n'est pas le cas avec 3 Mo de données et une inférence de moins d'une minute. Les points de terminaison en temps réel avec mise à l'échelle automatique à zéro peuvent fonctionner, mais les points de terminaison sans serveur sont une solution plus simple et plus rentable pour ce type de charge de travail intermittente.
Réussissez votre examen — sans la chasse aux réponses interminable
Obtenez toutes les questions et explications vérifiées pour cet examen en un seul endroit, et économisez des heures de préparation. Plus de 1 000 certifications · Plus de 20 langues · Gratuit pour commencer.
Réussissez votre examen plus rapidement → Pas de carte requise