Terabytes diários de dados de eventos do Google Analytics chegam ao BigQuery. As tabelas de perfil de cliente residem no Cloud SQL para MySQL e no Cloud SQL para PostgreSQL. O marketing precisa executar campanhas com junções 100 a 300 vezes por dia, minimizando a carga nas instâncias do Cloud SQL. O que você implementa?
Escolha uma resposta
Toque em uma opção para verificar sua resposta.
Resposta correta: Crie streams do Datastream para replicar as tabelas necessárias de ambos os bancos de dados Cloud SQL para o BigQuery..
Por que esta é a resposta
A replicação de dados do Cloud SQL para o BigQuery usando o Datastream é a solução mais eficiente. Isso permite que as junções de marketing sejam executadas diretamente no BigQuery, minimizando a carga nas instâncias do Cloud SQL, pois as consultas não precisam acessá-las diretamente. As conexões federadas do BigQuery (opção 1) ainda consultariam o Cloud SQL para cada junção, aumentando a carga. Um job Apache Spark no Dataproc Serverless (opção 2) ou um cluster Dataproc com Trino (opção 4) seriam soluções mais complexas e caras para gerenciar, além de ainda acessarem os bancos de dados Cloud SQL para cada consulta, o que não atende ao requisito de minimizar a carga.
Passe no seu exame — sem a busca interminável por respostas
Obtenha todas as perguntas e explicações verificadas para este exame em um só lugar e economize horas de preparação. Mais de 1.000 certificações · Mais de 20 idiomas · Grátis para começar.
Passe no seu exame mais rápido → Não é necessário cartão