В рамках пилотного проекта авиакомпания хранит ежедневные метрики в формате CSV в S3, разбитые по дате, и запрашивает их с помощью Amazon Athena. По мере роста объема данных компания хочет оптимизировать хранилище для повышения производительности запросов. Какие два действия следует предпринять? (Выберите два.)
Выберите ответ
Нажмите на вариант, чтобы проверить свой ответ.
Правильный ответ: Использовать бакет S3 в том же регионе AWS, где компания выполняет запросы Athena., Предварительно обработать данные .csv в формат Apache Parquet, извлекая только те блоки данных, которые необходимы для предикатов..
Почему это правильный ответ
Использование бакета S3 в том же регионе AWS, где выполняются запросы Athena, минимизирует задержку сети и затраты на передачу данных, что напрямую улучшает производительность запросов. Преобразование данных из CSV в Apache Parquet значительно повышает эффективность запросов Athena. Parquet — это колоночный формат хранения, который позволяет Athena считывать только необходимые столбцы (используя предикаты), а не всю строку, как в CSV. Это сокращает объем сканируемых данных, ускоряет запросы и снижает затраты. Добавление случайной строки не оптимизирует хранилище для производительности запросов Athena. Преобразование в JSON не дает таких преимуществ в производительности, как Parquet, поскольку JSON является строчным форматом.
Сдайте экзамен — без бесконечного поиска ответов
Получите все проверенные вопросы и объяснения для этого экзамена в одном месте и сэкономьте часы подготовки. 1000+ сертификаций · 20+ языков · начните бесплатно.
Сдайте экзамен быстрее → Карта не требуется