Basit bir BigQuery sorgusu olan SELECT country, state, city FROM mytable GROUP BY country her zaman yavaştır. Sorgu planı Stage:1'de yoğun okuma olduğunu gösteriyor. Bunun en olası nedeni nedir?
Bir cevap seçin
Cevabınızı kontrol etmek için bir seçeneğe dokunun.
Doğru cevap: Çoğu satır aynı ülke değerine sahip, bu da veri çarpıklığına neden oluyor.
Neden bu cevap
Bu sorgu, country sütununa göre gruplama yapmaktadır. Eğer tablodaki satırların çoğu aynı country değerine sahipse, bu durum veri çarpıklığına (data skew) yol açar. BigQuery, gruplama işlemlerini paralel olarak dağıtarak gerçekleştirir. Ancak, belirli bir country değeri için çok fazla veri varsa, bu veriyi işlemekle görevli olan düğüm aşırı yüklenir ve diğer düğümler boşta kalır. Bu da sorgunun Stage:1'de (genellikle okuma ve ilk işleme aşaması) yavaşlamasına neden olur, çünkü verinin büyük bir kısmı tek bir noktada yoğunlaşmıştır. Diğer seçenekler: Çok fazla eşzamanlı kullanıcı sorgusu, genel sistem performansını etkileyebilir ancak belirli bir sorgunun Stage:1'de yoğun okuma yapmasının doğrudan nedeni değildir. Tabloda çok fazla bölüm olması, sorgu bölümleme anahtarını kullanmıyorsa performansı olumsuz etkileyebilir, ancak bu durumda GROUP BY country ifadesi bölümlemeyi doğrudan hedeflemediğinden, asıl sorun veri çarpıklığıdır. state veya city sütunlarının NULL içermesi, bu sorgunun performansını doğrudan etkilemez, çünkü gruplama country sütunu üzerindendir.
Sonsuz cevap arayışı olmadan sınavınızı geçin
Bu sınav için her doğrulanmış soruyu ve açıklamayı tek bir yerde edinin ve saatlerce süren hazırlıktan tasarruf edin. 1.000'den fazla sertifika · 20'den fazla dil · ücretsiz başlayın.
Sınavınızı daha hızlı geçin → Kart gerekmez