Une entreprise doit générer des réponses synthétiques pour de nombreuses invites à partir d'un grand ensemble de données à l'aide d'une API. Les réponses n'ont pas besoin d'être immédiates. Quelle approche nécessite le moins d'effort de développement ?
Choisissez une réponse
Appuyez sur une option pour vérifier votre réponse.
Bonne réponse : Utiliser l'inférence par lots d'Amazon Bedrock pour générer des réponses de manière asynchrone..
Pourquoi c'est la réponse
L'inférence par lots d'Amazon Bedrock est la solution la plus efficace car elle est conçue pour traiter de grands volumes de données de manière asynchrone, sans nécessiter de développement complexe pour la gestion des files d'attente ou la parallélisation. Cette approche minimise l'effort de développement en tirant parti d'un service géré. L'inférence en temps réel serait coûteuse et moins efficace pour un grand ensemble de données sans exigence d'immédiateté. Les agents Amazon Bedrock sont plus adaptés aux tâches complexes nécessitant une logique de conversation ou d'orchestration, ce qui est excessif ici. AWS Lambda pourrait être utilisé, mais il nécessiterait un effort de développement plus important pour gérer la logique de traitement par lots, la gestion des erreurs et le stockage des réponses, par rapport à l'inférence par lots native de Bedrock.
Réussissez votre examen — sans la chasse aux réponses interminable
Obtenez toutes les questions et explications vérifiées pour cet examen en un seul endroit, et économisez des heures de préparation. Plus de 1 000 certifications · Plus de 20 langues · Gratuit pour commencer.
Réussissez votre examen plus rapidement → Pas de carte requise