Şirket içi bir Apache Spark 3 toplu işini (yürütücüler: 8 vCPU, 16 GB), minimum değişiklikle, benzer kaynakları seçme yeteneğiyle ve minimum yönetim yüküyle GCP'ye geçirin; iş, Cloud Storage'dan okur ve BigQuery'ye yazar.
Bir cevap seçin
Cevabınızı kontrol etmek için bir seçeneğe dokunun.
Doğru cevap: İşi Dataproc Serverless ile çalıştırın..
Neden bu cevap
Dataproc Serverless, mevcut Spark iş yüklerini minimum değişiklikle GCP'ye taşımak için idealdir. Yönetim yükünü en aza indirir çünkü altyapı yönetimi (küme sağlama, ölçeklendirme, yama) Google tarafından yapılır. İşin Cloud Storage'dan okuyup BigQuery'ye yazması, Dataproc Serverless'ın bu entegrasyonları doğal olarak desteklemesiyle uyumludur. Benzer kaynakları seçme yeteneği, Spark işinin mevcut kaynak gereksinimlerine (8 vCPU, 16 GB) uygun yapılandırmaların sunucusuz ortamda belirlenebileceği anlamına gelir. GKE, Spark işlerini çalıştırmak için kullanılabilir ancak bir Kubernetes kümesini yönetmek ek bir yönetim yükü getirir. Compute Engine VM, tam kontrol sağlarken, Spark kurulumu, yönetimi ve ölçeklendirmesi için önemli bir manuel çaba gerektirir. Yeni bir Dataproc kümesi oluşturmak, sunucusuz seçeneğe göre daha fazla yönetim gerektirir, çünkü küme yaşam döngüsü ve kaynak tahsisi yine de yönetilmelidir.
Sonsuz cevap arayışı olmadan sınavınızı geçin
Bu sınav için her doğrulanmış soruyu ve açıklamayı tek bir yerde edinin ve saatlerce süren hazırlıktan tasarruf edin. 1.000'den fazla sertifika · 20'den fazla dil · ücretsiz başlayın.
Sınavınızı daha hızlı geçin → Kart gerekmez