Un ingeniero de datos debe mantener un repositorio central de metadatos que sea accesible desde consultas de Amazon EMR y Amazon Athena, y debe importar metadatos existentes de Apache Hive en él con un esfuerzo de desarrollo mínimo. ¿Qué solución debería usar?
Elige una respuesta
Toca una opción para verificar tu respuesta.
Respuesta correcta: Usar el AWS Glue Data Catalog..
Por qué esta es la respuesta
El AWS Glue Data Catalog es la solución correcta porque es un repositorio centralizado de metadatos que es compatible con Apache Hive y es accesible tanto desde Amazon EMR como desde Amazon Athena. Permite importar metadatos de Hive existentes con un esfuerzo mínimo, lo que lo convierte en la opción ideal para este escenario. Usar Amazon EMR y Apache Ranger no es la solución principal para el catálogo de metadatos; Apache Ranger se enfoca en la seguridad y la autorización, no en el catálogo centralizado de metadatos. Usar un metastore de Hive en un clúster de EMR es una solución temporal y no un repositorio centralizado y persistente que pueda ser accedido por Athena. Usar un metastore en una instancia de base de datos de Amazon RDS for MySQL requeriría una configuración y mantenimiento manuales significativos, y no ofrecería la integración nativa y la facilidad de uso del AWS Glue Data Catalog.
Aprueba tu examen — sin la interminable búsqueda de respuestas
Obtén todas las preguntas y explicaciones verificadas para este examen en un solo lugar, y ahorra horas de preparación. Más de 1,000 certificaciones · Más de 20 idiomas · Empieza gratis.
Aprueba tu examen más rápido → No se requiere tarjeta