Migre o Hadoop on-prem para uma solução de nuvem gerenciada, tolerante a falhas e econômica para jobs em lote de longa duração. O que você deve implantar?
Escolha uma resposta
Toque em uma opção para verificar sua resposta.
Resposta correta: Crie um cluster Dataproc com discos persistentes padrão e 50% de workers preemptivos; armazene os dados no Cloud Storage e atualize os scripts de hdfs:// para gs://.
Por que esta é a resposta
A opção correta é a mais econômica e gerenciada para jobs em lote de longa duração. O Dataproc é um serviço gerenciado que simplifica a execução de clusters Hadoop/Spark. Usar discos persistentes padrão é mais barato que SSDs e adequado para jobs em lote que não exigem latência de I/O extremamente baixa. Workers preemptivos reduzem significativamente o custo, sendo ideais para jobs tolerantes a falhas. Armazenar dados no Cloud Storage desacopla o armazenamento da computação, oferecendo durabilidade, escalabilidade e menor custo, além de ser o padrão para o Dataproc. A atualização dos scripts de hdfs:// para gs:// é necessária para usar o Cloud Storage. A opção com discos SSD é mais cara sem um benefício proporcional para jobs em lote. Instalar Hadoop/Spark diretamente no Compute Engine aumenta a sobrecarga de gerenciamento e não oferece os benefícios de um serviço gerenciado como o Dataproc. Usar nós preemptivos do Compute Engine com HDFS local não é tolerante a falhas para o armazenamento e não é a abordagem recomendada para a nuvem.
Passe no seu exame — sem a busca interminável por respostas
Obtenha todas as perguntas e explicações verificadas para este exame em um só lugar e economize horas de preparação. Mais de 1.000 certificações · Mais de 20 idiomas · Grátis para começar.
Passe no seu exame mais rápido → Não é necessário cartão