Uma empresa particiona seu data lake no Amazon S3 usando caminhos de chave de objeto como s3://bucket/prefix/year=2023/month=01/day=01. O AWS Glue Data Catalog deve permanecer sincronizado com o S3 quando novas partições são adicionadas. Qual abordagem oferece a menor latência para manter o catálogo atualizado?
Escolha uma resposta
Toque em uma opção para verificar sua resposta.
Resposta correta: Usar código que grava dados no Amazon S3 para invocar a chamada de API Boto3 AWS Glue create_partition..
Por que esta é a resposta
A abordagem de menor latência é usar código que grava dados no Amazon S3 para invocar a chamada de API Boto3 AWS Glue createpartition. Isso garante que o catálogo seja atualizado imediatamente após a criação de novas partições, mantendo a sincronização em tempo quase real. Agendar um crawler do AWS Glue diariamente introduz latência, pois as novas partições só seriam descobertas na próxima execução agendada. Executar manualmente a API CreatePartition duas vezes ao dia também gera latência e é propenso a erros humanos. O comando MSCK REPAIR TABLE (equivalente ao ALTER TABLE RECOVER PARTITIONS em alguns contextos) é útil para sincronizar partições existentes, mas não oferece a mesma baixa latência que a atualização programática no momento da criação da partição.
Passe no seu exame — sem a busca interminável por respostas
Obtenha todas as perguntas e explicações verificadas para este exame em um só lugar e economize horas de preparação. Mais de 1.000 certificações · Mais de 20 idiomas · Grátis para começar.
Passe no seu exame mais rápido → Não é necessário cartão