Eine einfache BigQuery-Abfrage SELECT country, state, city FROM mytable GROUP BY country ist immer langsam. Der Abfrageplan zeigt eine hohe Leseaktivität in Stage:1. Was ist die wahrscheinlichste Ursache?
Wählen Sie eine Antwort
Tippen Sie auf eine Option, um Ihre Antwort zu überprüfen.
Richtige Antwort: Die meisten Zeilen haben denselben country-Wert, was zu einer Datenverzerrung führt.
Warum dies die Antwort ist
Eine hohe Leseaktivität in Stage:1 bei einer GROUP BY-Abfrage deutet oft auf eine ineffiziente Datenverarbeitung hin. Wenn die meisten Zeilen denselben country-Wert haben, entsteht eine Datenverzerrung (data skew). BigQuery muss dann einen Großteil der Daten auf wenige Worker konzentrieren, um die Aggregation für diesen dominanten country-Wert durchzuführen. Dies überlastet diese Worker, während andere unterfordert bleiben, was die Ausführung verlangsamt. Zu viele gleichzeitige Benutzerabfragen würden die Gesamtleistung des Systems beeinträchtigen, aber nicht spezifisch eine hohe Leseaktivität in Stage:1 für eine einzelne Abfrage erklären. Zu viele Partitionen können die Abfrageleistung beeinflussen, aber nicht primär durch hohe Leseaktivität in Stage:1 bei einer GROUP BY-Operation ohne Filter. NULL-Werte in state oder city sind für diese spezifische GROUP BY country-Abfrage irrelevant, da diese Spalten nicht in der GROUP BY-Klausel verwendet werden.
Bestehen Sie Ihre Prüfung – ohne endlose Antwortsuche
Erhalten Sie jede verifizierte Frage und Erklärung für diese Prüfung an einem Ort und sparen Sie Stunden der Vorbereitung. Über 1.000 Zertifizierungen · Über 20 Sprachen · Kostenloser Start.
Bestehen Sie Ihre Prüfung schneller → Keine Karte erforderlich