Uma empresa está carregando centenas de arquivos em uma tabela de fatos em um cluster Amazon Redshift e deseja a maior taxa de transferência de carregamento possível, usando os recursos do cluster de forma eficiente. Qual estratégia de carregamento melhor atenderá a esses objetivos?
Escolha uma resposta
Toque em uma opção para verificar sua resposta.
Resposta correta: Use um único comando COPY para carregar os dados no cluster Redshift..
Por que esta é a resposta
Um único comando COPY é a estratégia mais eficiente para carregar grandes volumes de dados no Amazon Redshift, especialmente quando se trata de centenas de arquivos. O comando COPY é projetado para paralelizar o carregamento de dados entre os nós do cluster, aproveitando ao máximo os recursos computacionais e de I/O. Ele pode ler múltiplos arquivos de um bucket S3 em paralelo, distribuindo a carga de trabalho de forma otimizada. Usar vários comandos COPY seria menos eficiente devido à sobrecarga de iniciar e gerenciar múltiplas transações e processos. S3DistCp é para mover dados entre S3 e HDFS, o que não é relevante para carregar diretamente no Redshift. Usar múltiplas instruções INSERT é a forma menos eficiente de carregar dados em Redshift, pois cada INSERT é uma operação individual e não se beneficia do paralelismo massivo que o COPY oferece.
Passe no seu exame — sem a busca interminável por respostas
Obtenha todas as perguntas e explicações verificadas para este exame em um só lugar e economize horas de preparação. Mais de 1.000 certificações · Mais de 20 idiomas · Grátis para começar.
Passe no seu exame mais rápido → Não é necessário cartão