Uma empresa armazena registros diários de desempenho de portfólio como arquivos .csv no Amazon S3 e usa crawlers do AWS Glue para catalogar os dados. Os dados devem estar disponíveis no AWS Glue Data Catalog todos os dias. Qual configuração atende a esse requisito?
Escolha uma resposta
Toque em uma opção para verificar sua resposta.
Resposta correta: Crie uma função do IAM que inclua a política AWSGlueServiceRole. Anexe a função ao crawler. Aponte o crawler para o caminho de origem do S3. Crie um agendamento diário para executar o crawler. Especifique um nome de banco de dados para a saída..
Por que esta é a resposta
A opção correta descreve os passos essenciais para catalogar dados diariamente com o AWS Glue. A política AWSGlueServiceRole fornece as permissões necessárias para o Glue acessar o S3 e gravar no Data Catalog. Apontar o crawler para o caminho de origem do S3 é fundamental para identificar os dados. Um agendamento diário garante que os novos registros de desempenho sejam catalogados todos os dias. Especificar um nome de banco de dados organiza as tabelas no Data Catalog. As outras opções estão incorretas porque: A política AmazonS3FullAccess é excessiva e não é a política padrão ou recomendada para o Glue; a AWSGlueServiceRole é a mais adequada. Além disso, gravar a saída em um novo caminho no S3 não é a função principal de um crawler, que é catalogar metadados. Alocar DPUs (Data Processing Units) é uma configuração de desempenho, não um substituto para agendamento ou permissões. A última opção combina o erro da política AmazonS3FullAccess com a configuração incorreta de gravação em um novo caminho S3.
Passe no seu exame — sem a busca interminável por respostas
Obtenha todas as perguntas e explicações verificadas para este exame em um só lugar e economize horas de preparação. Mais de 1.000 certificações · Mais de 20 idiomas · Grátis para começar.
Passe no seu exame mais rápido → Não é necessário cartão