Ein Unternehmen lädt Hunderte von Dateien in eine Faktentabelle in einem Amazon Redshift-Cluster und möchte den höchstmöglichen Ladedurchsatz bei effizienter Nutzung der Cluster-Ressourcen erreichen. Welche Ladestrategie erfüllt diese Ziele am besten?
Wählen Sie eine Antwort
Tippen Sie auf eine Option, um Ihre Antwort zu überprüfen.
Richtige Antwort: Verwenden Sie einen einzelnen COPY-Befehl, um die Daten in den Redshift-Cluster zu laden..
Warum dies die Antwort ist
Ein einzelner COPY-Befehl ist die effizienteste Methode, um große Mengen von Dateien in Amazon Redshift zu laden. Redshift ist darauf ausgelegt, die Daten aus mehreren Dateien, die in einem S3-Bucket gespeichert sind, automatisch parallel zu verarbeiten und auf die Compute-Knoten zu verteilen. Dies maximiert den Durchsatz und nutzt die Cluster-Ressourcen optimal. Mehrere COPY-Befehle würden Overhead verursachen und die Leistung mindern. S3DistCp ist für Hadoop gedacht und nicht direkt für Redshift-Ladevorgänge. INSERT-Anweisungen sind für große Datenmengen in Redshift extrem ineffizient, da sie zeilenweise verarbeitet werden und nicht die parallelen Ladefunktionen von COPY nutzen.
Bestehen Sie Ihre Prüfung – ohne endlose Antwortsuche
Erhalten Sie jede verifizierte Frage und Erklärung für diese Prüfung an einem Ort und sparen Sie Stunden der Vorbereitung. Über 1.000 Zertifizierungen · Über 20 Sprachen · Kostenloser Start.
Bestehen Sie Ihre Prüfung schneller → Keine Karte erforderlich