Простой запрос BigQuery `SELECT country, state, city FROM mytable GROUP BY country` всегда выполняется медленно. План запроса показывает интенсивное чтение на Stage:1. Какова наиболее вероятная причина?
Выберите ответ
Нажмите на вариант, чтобы проверить свой ответ.
Правильный ответ: Большинство строк имеют одинаковое значение `country`, что вызывает перекос данных.
Почему это правильный ответ
Наиболее вероятной причиной медленного выполнения запроса и интенсивного чтения на Stage:1 является перекос данных (data skew). Если большинство строк имеют одинаковое значение в столбце country, BigQuery сталкивается с проблемой распределения работы: один или несколько шардов будут обрабатывать значительно больше данных, чем другие, что замедляет выполнение запроса в целом. Операция GROUP BY по такому столбцу усугубляет эту проблему, поскольку данные с одинаковыми значениями должны быть собраны вместе. Другие варианты менее вероятны: Слишком много одновременных пользовательских запросов может влиять на общую производительность, но не объясняет интенсивное чтение на Stage:1 для конкретного запроса. Слишком много партиций обычно не является проблемой для BigQuery, скорее наоборот, помогает оптимизировать запросы. Наличие значений NULL в столбцах state или city не влияет на производительность GROUP BY country, поскольку эти столбцы не используются в группировке.
Сдайте экзамен — без бесконечного поиска ответов
Получите все проверенные вопросы и объяснения для этого экзамена в одном месте и сэкономьте часы подготовки. 1000+ сертификаций · 20+ языков · начните бесплатно.
Сдайте экзамен быстрее → Карта не требуется