Una empresa está migrando clústeres Hadoop on-premises a Amazon EMR y necesita mover un metastore de Apache Hive existente a una solución persistente y sin servidor para el catálogo de datos. ¿Qué enfoque es el más rentable y cumple con el requisito de ser sin servidor?
Elige una respuesta
Toca una opción para verificar tu respuesta.
Respuesta correcta: Configurar un metastore de Hive en Amazon EMR. Migrar el metastore de Hive on-premises existente a Amazon EMR. Usar AWS Glue Data Catalog para almacenar el catálogo de datos de la empresa como un catálogo de datos externo..
Por qué esta es la respuesta
La opción correcta es la más rentable y sin servidor porque AWS Glue Data Catalog es un servicio de catálogo de datos totalmente administrado y sin servidor que puede actuar como un metastore de Hive compatible. Al migrar el metastore de Hive existente a AWS Glue Data Catalog, la empresa elimina la necesidad de administrar una base de datos de metastore subyacente y solo paga por el almacenamiento y las solicitudes, lo que lo hace rentable. Las otras opciones son incorrectas: Migrar a Amazon S3 con AWS DMS y luego escanear con Glue Data Catalog no es el enfoque directo para un metastore de Hive, ya que S3 no es un metastore de Hive nativo y requeriría pasos adicionales para replicar la funcionalidad del metastore. Configurar un metastore de Hive externo en Amazon EMR con Amazon Aurora MySQL implica gestionar una base de datos Aurora, lo que no cumple con el requisito de ser sin servidor. Configurar un nuevo metastore de Hive en Amazon EMR y usarlo como catálogo de datos de la empresa no es sin servidor, ya que el metastore de Hive en EMR requiere recursos de cómputo y almacenamiento que deben ser gestionados.
Aprueba tu examen — sin la interminable búsqueda de respuestas
Obtén todas las preguntas y explicaciones verificadas para este examen en un solo lugar, y ahorra horas de preparación. Más de 1,000 certificaciones · Más de 20 idiomas · Empieza gratis.
Aprueba tu examen más rápido → No se requiere tarjeta