Un ingénieur de données doit maintenir un référentiel de métadonnées central accessible depuis les requêtes Amazon EMR et Amazon Athena, et doit y importer des métadonnées Apache Hive existantes avec un effort de développement minimal. Quelle solution devrait-il utiliser ?
Choisissez une réponse
Appuyez sur une option pour vérifier votre réponse.
Bonne réponse : Utiliser l'AWS Glue Data Catalog..
Pourquoi c'est la réponse
L'AWS Glue Data Catalog est la solution la plus appropriée car il s'agit d'un référentiel de métadonnées centralisé, serverless et compatible Apache Hive Metastore. Il s'intègre nativement avec Amazon EMR et Amazon Athena, permettant aux deux services d'accéder aux mêmes métadonnées sans effort de développement supplémentaire. Il prend également en charge l'importation de métadonnées Apache Hive existantes. Utiliser Amazon EMR et Apache Ranger n'est pas suffisant car Apache Ranger est un cadre de sécurité et non un référentiel de métadonnées. Utiliser un metastore Hive sur un cluster EMR n'est pas centralisé et ne serait pas directement accessible par Athena sans configuration supplémentaire. Utiliser un metastore sur une instance Amazon RDS for MySQL nécessiterait une gestion manuelle de la base de données et des intégrations personnalisées avec EMR et Athena.
Réussissez votre examen — sans la chasse aux réponses interminable
Obtenez toutes les questions et explications vérifiées pour cet examen en un seul endroit, et économisez des heures de préparation. Plus de 1 000 certifications · Plus de 20 langues · Gratuit pour commencer.
Réussissez votre examen plus rapidement → Pas de carte requise