Um engenheiro de dados está carregando dados de clientes de terceiros no Amazon Redshift. Um campo de origem contém valores formatados em JSON. Para carregar o JSON no data warehouse com o mínimo esforço, o que o engenheiro deve fazer?
Escolha uma resposta
Toque em uma opção para verificar sua resposta.
Resposta correta: Usar o tipo de dados SUPER para armazenar os dados na tabela do Amazon Redshift..
Por que esta é a resposta
A opção correta é usar o tipo de dados SUPER para armazenar os dados na tabela do Amazon Redshift. O tipo de dados SUPER no Amazon Redshift foi projetado especificamente para lidar com dados semiestruturados, como JSON, permitindo que você os ingira diretamente sem a necessidade de pré-processamento complexo. Isso minimiza o esforço, pois você pode consultar e analisar os dados JSON aninhados diretamente no Redshift usando a notação de pontos e outras funções. Usar o AWS Glue para nivelar os dados JSON e ingeri-los no Redshift é uma solução válida, mas exige um esforço adicional para criar e gerenciar jobs de ETL. Armazenar os dados JSON no Amazon S3 e usar o Amazon Athena para consultá-los é uma boa opção para análise de dados em S3, mas não os carrega no Redshift. Usar uma função AWS Lambda para nivelar os dados JSON e armazená-los no S3 é uma abordagem de ETL personalizada que também adiciona complexidade e esforço em comparação com o uso direto do tipo SUPER no Redshift.
Passe no seu exame — sem a busca interminável por respostas
Obtenha todas as perguntas e explicações verificadas para este exame em um só lugar e economize horas de preparação. Mais de 1.000 certificações · Mais de 20 idiomas · Grátis para começar.
Passe no seu exame mais rápido → Não é necessário cartão