Um engenheiro de dados deve manter um repositório central de metadados que seja acessível a partir de consultas do Amazon EMR e do Amazon Athena e deve importar metadados existentes do Apache Hive para ele com o mínimo esforço de desenvolvimento. Qual solução ele deve usar?
Escolha uma resposta
Toque em uma opção para verificar sua resposta.
Resposta correta: Usar o AWS Glue Data Catalog..
Por que esta é a resposta
O AWS Glue Data Catalog é a solução correta porque é um repositório centralizado de metadados que integra-se nativamente com Amazon EMR e Amazon Athena. Ele permite importar metadados existentes do Apache Hive com o mínimo esforço, pois é compatível com a API do Apache Hive Metastore. Usar Amazon EMR e Apache Ranger não é a melhor opção, pois o Apache Ranger foca em segurança e autorização, não em um repositório central de metadados para ambos os serviços. Usar um Hive metastore em um cluster EMR não é centralizado e os metadados seriam perdidos se o cluster fosse encerrado, além de não ser diretamente acessível pelo Athena sem configurações adicionais. Usar um metastore em uma instância de banco de dados Amazon RDS for MySQL exigiria gerenciamento manual e integração complexa com EMR e Athena, sem a facilidade de importação de metadados do Hive que o Glue Data Catalog oferece.
Passe no seu exame — sem a busca interminável por respostas
Obtenha todas as perguntas e explicações verificadas para este exame em um só lugar e economize horas de preparação. Mais de 1.000 certificações · Mais de 20 idiomas · Grátis para começar.
Passe no seu exame mais rápido → Não é necessário cartão