Компании требуется централизованный каталог данных и управление метаданными для облачных источников данных (структурированных источников, таких как Amazon RDS и Redshift, и полуструктурированных файлов в S3). Каталог должен регулярно обновляться и обнаруживать изменения метаданных с минимальными операционными издержками. Какое решение соответствует этим требованиям?
Выберите ответ
Нажмите на вариант, чтобы проверить свой ответ.
Правильный ответ: Использовать AWS Glue Data Catalog в качестве центрального репозитория метаданных. Настроить AWS Glue crawlers для подключения к различным хранилищам данных и обновления Data Catalog с обнаруженными изменениями метаданных. Запланировать регулярный запуск crawlers для обновления каталога..
Почему это правильный ответ
Правильный ответ — использование AWS Glue Data Catalog с AWS Glue crawlers. AWS Glue Data Catalog — это управляемый, централизованный репозиторий метаданных, который идеально подходит для этой задачи, поскольку он предназначен для хранения метаданных из различных источников данных AWS. AWS Glue crawlers автоматически подключаются к источникам данных (Amazon RDS, Redshift, S3), определяют схемы и обновляют Data Catalog с минимальными операционными издержками, что соответствует требованиям к регулярному обновлению и обнаружению изменений. Использование Amazon Aurora или DynamoDB с функциями Lambda для создания каталога данных требует значительных усилий по разработке и обслуживанию для реализации функциональности, которую Glue Data Catalog предоставляет из коробки. Хотя AWS Glue Data Catalog используется в последнем неверном варианте, он предлагает ручное извлечение схем для RDS и Redshift, что менее эффективно, чем автоматическое обнаружение с помощью crawlers для всех источников.
Сдайте экзамен — без бесконечного поиска ответов
Получите все проверенные вопросы и объяснения для этого экзамена в одном месте и сэкономьте часы подготовки. 1000+ сертификаций · 20+ языков · начните бесплатно.
Сдайте экзамен быстрее → Карта не требуется