Ein Einzelhandelsunternehmen speichert Transaktionen, Filialstandorte und Kundentabellen auf einem Amazon Redshift-Cluster mit vier Knoten (reserviert, ra3.4xlarge). Alle Tabellen verwenden derzeit die EVEN-Verteilung. Die Tabelle der Filialstandorte wird sehr selten aktualisiert, aber Abfragen sind langsam, da die Tabelle an alle vier Compute-Knoten übertragen wird. Was sollte der Dateningenieur tun, um die Übertragung zu reduzieren und Abfragen auf die kostengünstigste Weise zu beschleunigen?
Wählen Sie eine Antwort
Tippen Sie auf eine Option, um Ihre Antwort zu überprüfen.
Richtige Antwort: Ändern Sie den Verteilungsstil der Tabelle der Filialstandorte von EVEN-Verteilung auf ALL-Verteilung..
Warum dies die Antwort ist
Die ALL-Verteilung ist die beste Lösung, da die Tabelle der Filialstandorte klein ist und selten aktualisiert wird. Durch die ALL-Verteilung wird eine vollständige Kopie der Tabelle auf jedem Compute-Knoten gespeichert, wodurch die Notwendigkeit entfällt, die Tabelle während Abfragen über das Netzwerk zu verschieben. Dies reduziert die Übertragung und beschleunigt Abfragen erheblich, insbesondere bei Joins mit großen Faktentabellen. Die KEY-Verteilung wäre für die Filialstandorte nicht optimal, da die Tabelle klein ist und eine Verteilung nach einem Schlüssel die Daten möglicherweise nicht gleichmäßig verteilt oder die Übertragung bei Joins nicht so effektiv reduziert wie die ALL-Verteilung. Das Hinzufügen einer Join-Spalte zum Sortierschlüssel würde die Sortierung verbessern, aber nicht die Datenübertragung reduzieren. Ein Upgrade der Knoteninstanzgröße wäre teurer und würde das zugrunde liegende Problem der Datenübertragung nicht direkt lösen.
Bestehen Sie Ihre Prüfung – ohne endlose Antwortsuche
Erhalten Sie jede verifizierte Frage und Erklärung für diese Prüfung an einem Ort und sparen Sie Stunden der Vorbereitung. Über 1.000 Zertifizierungen · Über 20 Sprachen · Kostenloser Start.
Bestehen Sie Ihre Prüfung schneller → Keine Karte erforderlich