Поток Kafka передает события отслеживания посылок в BigQuery. Таблица была создана с секционированием по дате приема данных, и задержка запросов увеличилась. Аналитики запрашивают геопространственные тренды по посылкам. Какое изменение улучшит производительность запросов BigQuery?
Выберите ответ
Нажмите на вариант, чтобы проверить свой ответ.
Правильный ответ: Добавить кластеризацию по столбцу package-tracking ID..
Почему это правильный ответ
Кластеризация по столбцу package-tracking ID значительно улучшит производительность запросов, поскольку аналитики запрашивают геопространственные тренды по посылкам, что подразумевает фильтрацию или агрегацию данных по отдельным посылкам. BigQuery будет эффективно сканировать только те блоки данных, которые содержат нужные package-tracking ID, уменьшая объем обрабатываемых данных. Секционирование по дате приема данных уже есть, но оно не помогает при запросах по конкретным посылкам. Добавление кластеризации по ingest-date не принесет существенного улучшения, так как секционирование уже выполняет эту роль. Архивирование данных в Cloud Storage не решит проблему производительности запросов к активным данным. Пересоздание таблицы с секционированием по дате доставки может быть полезно для других типов запросов, но не для текущей задачи по геопространственным трендам по посылкам.
Сдайте экзамен — без бесконечного поиска ответов
Получите все проверенные вопросы и объяснения для этого экзамена в одном месте и сэкономьте часы подготовки. 1000+ сертификаций · 20+ языков · начните бесплатно.
Сдайте экзамен быстрее → Карта не требуется