Você deve armazenar dados de origem brutos e não estruturados exatamente como foram recuperados (o esquema pode mudar) para posterior reprocessamento. Onde você deve colocar os dados brutos e como os pipelines devem acessá-los?
Escolha uma resposta
Toque em uma opção para verificar sua resposta.
Resposta correta: Armazene os dados em um bucket do Cloud Storage. Projete os pipelines de processamento para recuperar os dados do bucket..
Por que esta é a resposta
O Cloud Storage é ideal para dados brutos e não estruturados, pois não impõe um esquema e suporta uma ampla variedade de formatos de arquivo, o que é crucial quando o esquema pode mudar. Os pipelines podem acessar esses dados diretamente do bucket para reprocessamento. As opções que envolvem o BigQuery são menos adequadas para dados brutos e não estruturados, pois o BigQuery é um data warehouse colunar que exige um esquema definido, o que não se alinha com a necessidade de armazenar dados "exatamente como foram recuperados" e com um esquema que pode mudar. Armazenar apenas dados processados não atende ao requisito de manter os dados brutos para reprocessamento futuro.
Passe no seu exame — sem a busca interminável por respostas
Obtenha todas as perguntas e explicações verificadas para este exame em um só lugar e economize horas de preparação. Mais de 1.000 certificações · Mais de 20 idiomas · Grátis para começar.
Passe no seu exame mais rápido → Não é necessário cartão