Специалисту по данным необходимо проанализировать примерно 500 ГБ исторических данных об инвентаризации, хранящихся в виде CSV-файлов в озере данных Amazon S3. Он хочет использовать SQL для анализа, а компания стремится минимизировать затраты и операционные издержки. Какой подход удовлетворяет этим требованиям с наименьшими операционными затратами?
Выберите ответ
Нажмите на вариант, чтобы проверить свой ответ.
Правильный ответ: Использовать AWS Glue для сканирования корзины S3 и заполнения AWS Glue Data Catalog, затем запрашивать данные с помощью Amazon Athena..
Почему это правильный ответ
Использование AWS Glue для сканирования корзины S3 и заполнения AWS Glue Data Catalog, а затем запросы данных с помощью Amazon Athena, является наиболее экономичным и наименее операционно затратным решением. Athena — это бессерверный сервис запросов, который платит только за объем сканированных данных, что идеально подходит для нечастых аналитических задач. AWS Glue Data Catalog автоматически управляет метаданными, устраняя необходимость в ручном управлении схемами. Подготовка кластера Amazon EMR требует постоянного управления кластером и связанных с этим затрат, даже если он не используется активно. Amazon Redshift, будь то загрузка данных или использование внешних таблиц, также предполагает управление кластером и постоянные затраты, что противоречит цели минимизации затрат и операционных издержек для исторических данных.
Сдайте экзамен — без бесконечного поиска ответов
Получите все проверенные вопросы и объяснения для этого экзамена в одном месте и сэкономьте часы подготовки. 1000+ сертификаций · 20+ языков · начните бесплатно.
Сдайте экзамен быстрее → Карта не требуется