Ein Dateningenieur muss die Leistung von SQL-Abfragen auf einem Amazon Redshift-Cluster verbessern, kann aber die Clustergröße nicht erhöhen. Die Daten werden mit dem EVEN-Verteilungsstil verteilt. Einige Tabellen sind Hunderte von GB groß, andere unter 10 MB. Welcher Ansatz verbessert die Leistung unter den gegebenen Einschränkungen?
Wählen Sie eine Antwort
Tippen Sie auf eine Option, um Ihre Antwort zu überprüfen.
Richtige Antwort: Den ALL-Verteilungsstil für selten aktualisierte kleine Tabellen verwenden. Primär- und Fremdschlüssel für alle Tabellen angeben..
Warum dies die Antwort ist
Der ALL-Verteilungsstil für kleine, selten aktualisierte Tabellen ist korrekt, da er eine vollständige Kopie der Tabelle auf jedem Compute-Knoten speichert. Dies eliminiert die Notwendigkeit, Daten über das Netzwerk zu verschieben (Broadcast), wenn diese kleinen Tabellen mit größeren Tabellen verknüpft werden, was die Abfrageleistung erheblich verbessert. Die Angabe von Primär- und Fremdschlüsseln hilft dem Redshift-Abfrageoptimierer, effizientere Ausführungspläne zu erstellen, obwohl Redshift diese nicht erzwingt. Die Beibehaltung des EVEN-Verteilungsstils für alle Tabellen würde die Leistung nicht verbessern, da kleine Tabellen weiterhin über das Netzwerk verteilt werden müssten. Der ALL-Verteilungsstil für große Tabellen ist ineffizient, da er zu einer übermäßigen Datenduplizierung und Speicherplatzverschwendung führen würde. Die Kombination von Verteilungs-, Sortier- und Partitionsschlüsseln ist zwar im Allgemeinen eine gute Praxis, aber der ALL-Verteilungsstil ist die spezifischste und effektivste Lösung für das gegebene Problem der kleinen Tabellen.
Bestehen Sie Ihre Prüfung – ohne endlose Antwortsuche
Erhalten Sie jede verifizierte Frage und Erklärung für diese Prüfung an einem Ort und sparen Sie Stunden der Vorbereitung. Über 1.000 Zertifizierungen · Über 20 Sprachen · Kostenloser Start.
Bestehen Sie Ihre Prüfung schneller → Keine Karte erforderlich