Una semplice query BigQuery, SELECT country, state, city FROM mytable GROUP BY country, è sempre lenta. Il piano di query mostra un'intensa attività di lettura in Stage:1. Qual è la causa più probabile?
Scegli una risposta
Tocca un'opzione per controllare la tua risposta.
Risposta corretta: La maggior parte delle righe ha lo stesso valore di country, causando uno skew dei dati.
Perché questa è la risposta
La risposta corretta è che la maggior parte delle righe ha lo stesso valore di country, causando uno skew dei dati. In BigQuery, un'operazione GROUP BY su una colonna con pochi valori distinti (e quindi molti valori uguali) può portare a uno skew dei dati. Questo significa che un numero sproporzionato di dati viene elaborato da pochi worker, rallentando l'intero stage. L'intensa attività di lettura in Stage:1 suggerisce che i dati vengono letti e distribuiti in modo inefficiente prima dell'aggregazione. Le altre opzioni sono meno probabili: Troppe query utente concorrenti potrebbero rallentare il sistema in generale, ma non spiegherebbero specificamente l'intensa attività di lettura in Stage:1 per questa query. Troppe partizioni in una tabella BigQuery di solito migliorano le prestazioni di query che filtrano per partizione, non le peggiorano. Valori NULL nelle colonne state o city non influenzano direttamente le prestazioni di un GROUP BY sulla colonna country.
Supera il tuo esame — senza l'infinita caccia alle risposte
Ottieni ogni domanda e spiegazione verificata per questo esame in un unico posto, e risparmia ore di preparazione. Oltre 1.000 certificazioni · Oltre 20 lingue · Inizia gratuitamente.
Supera il tuo esame più velocemente → Nessuna carta richiesta