Você espera um grande aumento nos jobs do Spark e Hadoop de um datacenter on-prem e deseja escalabilidade na nuvem com o mínimo de trabalho operacional e alterações de código. Qual produto você deve usar?
Escolha uma resposta
Toque em uma opção para verificar sua resposta.
Resposta correta: Google Cloud Dataproc.
Por que esta é a resposta
O Google Cloud Dataproc é a escolha ideal porque é um serviço gerenciado para executar clusters Apache Spark e Hadoop. Ele permite migrar cargas de trabalho existentes com poucas ou nenhuma alteração de código, oferecendo escalabilidade automática e reduzindo significativamente o trabalho operacional. O Google Cloud Dataflow é um serviço gerenciado para processamento de dados em lote e streaming, mas é baseado no Apache Beam e exigiria reescrita de código para jobs Spark/Hadoop existentes. O Google Compute Engine oferece máquinas virtuais, mas exigiria que você gerenciasse e configurasse manualmente todo o ambiente Spark/Hadoop. O Google Kubernetes Engine é uma plataforma para orquestração de contêineres, útil para aplicações, mas não otimizado para a execução de clusters Spark/Hadoop com o mínimo de esforço operacional.
Passe no seu exame — sem a busca interminável por respostas
Obtenha todas as perguntas e explicações verificadas para este exame em um só lugar e economize horas de preparação. Mais de 1.000 certificações · Mais de 20 idiomas · Grátis para começar.
Passe no seu exame mais rápido → Não é necessário cartão