Une équipe de science des données stockera de nombreux jeux de données d'entraînement différents et doit prendre en charge la mise à l'échelle automatique, la rentabilité et l'exploration basée sur SQL. Quelle approche de stockage est la mieux adaptée à ce cas d'utilisation ?
Choisissez une réponse
Appuyez sur une option pour vérifier votre réponse.
Bonne réponse : Enregistrer les jeux de données sous forme de fichiers dans Amazon S3..
Pourquoi c'est la réponse
Stocker les jeux de données sous forme de fichiers dans Amazon S3 est la meilleure approche car S3 offre une évolutivité quasi illimitée, une haute durabilité et est très rentable pour le stockage de grands volumes de données. Il s'intègre également facilement avec des services d'exploration SQL comme Amazon Athena, permettant une analyse directe des données stockées. Stocker les jeux de données sur un volume Amazon EBS n'est pas idéal car EBS est lié à une instance EC2 spécifique et n'est pas conçu pour une évolutivité indépendante ou une exploration SQL directe sur les fichiers. Conserver les jeux de données dans un cluster Amazon Redshift est coûteux pour le stockage brut de fichiers et est optimisé pour les entrepôts de données structurées, pas pour le stockage de jeux de données bruts. Stocker les jeux de données sous forme de tables globales dans Amazon DynamoDB n'est pas adapté car DynamoDB est une base de données NoSQL clé-valeur et n'est pas optimisé pour le stockage de grands jeux de données d'entraînement sous forme de fichiers ou pour l'exploration SQL.
Réussissez votre examen — sans la chasse aux réponses interminable
Obtenez toutes les questions et explications vérifiées pour cet examen en un seul endroit, et économisez des heures de préparation. Plus de 1 000 certifications · Plus de 20 langues · Gratuit pour commencer.
Réussissez votre examen plus rapidement → Pas de carte requise