Um engenheiro de dados deve melhorar o desempenho de consultas SQL em um cluster Amazon Redshift, mas não pode aumentar o tamanho do cluster. Os dados são distribuídos com o estilo de distribuição EVEN. Algumas tabelas têm centenas de GB, outras têm menos de 10 MB. Qual abordagem melhorará o desempenho dadas as restrições?
Escolha uma resposta
Toque em uma opção para verificar sua resposta.
Resposta correta: Usar o estilo de distribuição ALL para tabelas pequenas raramente atualizadas. Especificar chaves primárias e estrangeiras para todas as tabelas..
Por que esta é a resposta
A opção correta melhora o desempenho porque o estilo de distribuição ALL replica a tabela inteira em todos os nós de computação, eliminando a necessidade de mover dados entre nós durante junções. Isso é ideal para tabelas pequenas e estáticas, pois o custo de replicação é baixo e as junções são executadas localmente. Especificar chaves primárias e estrangeiras ajuda o otimizador de consultas, embora o Redshift não as imponha. A primeira opção, manter a distribuição EVEN, não resolve o problema de desempenho, pois dados de tabelas grandes ainda precisariam ser redistribuídos para junções. A segunda opção, usar ALL para tabelas grandes, é ineficiente e cara, pois replicar centenas de GB em cada nó consome muito espaço e recursos. A quarta opção, usar chaves de partição, não é um recurso do Redshift, que utiliza chaves de distribuição e classificação.
Passe no seu exame — sem a busca interminável por respostas
Obtenha todas as perguntas e explicações verificadas para este exame em um só lugar e economize horas de preparação. Mais de 1.000 certificações · Mais de 20 idiomas · Grátis para começar.
Passe no seu exame mais rápido → Não é necessário cartão