Une requête BigQuery simple, SELECT country, state, city FROM mytable GROUP BY country, est toujours lente. Le plan de requête indique une lecture intensive dans l'Étape 1. Quelle en est la cause la plus probable ?
Choisissez une réponse
Appuyez sur une option pour vérifier votre réponse.
Bonne réponse : La plupart des lignes ont la même valeur de pays, ce qui provoque un déséquilibre des données (data skew).
Pourquoi c'est la réponse
Un déséquilibre des données (data skew) se produit lorsque la plupart des lignes d'une table partagent la même valeur pour une colonne utilisée dans une clause GROUP BY. Dans ce cas, si la colonne country a une valeur très fréquente (par exemple, "USA" pour 90% des lignes), BigQuery doit traiter un volume disproportionné de données pour ce groupe, ce qui ralentit considérablement l'étape de lecture et de regroupement. Le plan de requête montrant une lecture intensive à l'Étape 1 est un indicateur clé de ce problème. Les requêtes concurrentes peuvent ralentir, mais n'expliquent pas une lecture intensive spécifique à une étape. Un nombre excessif de partitions n'est généralement pas un problème pour BigQuery, qui gère automatiquement le partitionnement. Les valeurs NULL n'affectent pas intrinsèquement la performance de GROUP BY de cette manière, car elles sont traitées comme n'importe quelle autre valeur distincte.
Réussissez votre examen — sans la chasse aux réponses interminable
Obtenez toutes les questions et explications vérifiées pour cet examen en un seul endroit, et économisez des heures de préparation. Plus de 1 000 certifications · Plus de 20 langues · Gratuit pour commencer.
Réussissez votre examen plus rapidement → Pas de carte requise