Sie müssen einen 30-Knoten-Hadoop-Cluster in die Cloud migrieren, bestehende Hadoop-Jobs wiederverwenden, die Clusterverwaltung minimieren und Daten über die Lebensdauer des Clusters hinaus speichern. Was sollten Sie tun?
Wählen Sie eine Antwort
Tippen Sie auf eine Option, um Ihre Antwort zu überprüfen.
Richtige Antwort: Erstellen Sie einen Cloud Dataproc-Cluster, der den Google Cloud Storage-Konnektor verwendet..
Warum dies die Antwort ist
Die Erstellung eines Cloud Dataproc-Clusters mit dem Google Cloud Storage (GCS)-Konnektor ist die beste Lösung. Dataproc ermöglicht die Wiederverwendung bestehender Hadoop-Jobs und minimiert den Verwaltungsaufwand durch einen verwalteten Dienst. Die Verwendung von GCS als Speicher entkoppelt die Daten vom Cluster, was bedeutet, dass die Daten über die Lebensdauer des Clusters hinaus bestehen bleiben, selbst wenn der Cluster beendet wird. GCS bietet zudem hohe Skalierbarkeit und Haltbarkeit. Ein Google Cloud Dataflow-Job ist für die Verarbeitung von Daten geeignet, aber nicht für die Wiederverwendung bestehender Hadoop-Jobs im ursprünglichen Format. Ein Dataproc-Cluster mit Persistent Disks für HDFS würde die Daten an den Cluster binden und erfordert mehr Verwaltungsaufwand für die Persistenz. Ein Hadoop-Cluster auf Compute Engine erfordert erheblichen Verwaltungsaufwand. Die Verwendung von Local SSDs auf Compute Engine ist für temporäre Daten geeignet, aber nicht für die dauerhafte Speicherung über die Cluster-Lebensdauer hinaus, da Local SSDs flüchtig sind.
Bestehen Sie Ihre Prüfung – ohne endlose Antwortsuche
Erhalten Sie jede verifizierte Frage und Erklärung für diese Prüfung an einem Ort und sparen Sie Stunden der Vorbereitung. Über 1.000 Zertifizierungen · Über 20 Sprachen · Kostenloser Start.
Bestehen Sie Ihre Prüfung schneller → Keine Karte erforderlich