Компания переносит свои локальные кластеры Hadoop в Amazon EMR и ей необходимо переместить существующее хранилище метаданных Apache Hive в постоянное бессерверное решение для каталога данных. Какой подход является наиболее экономически эффективным и соответствует требованиям бессерверности?
Выберите ответ
Нажмите на вариант, чтобы проверить свой ответ.
Правильный ответ: Настроить Hive metastore в Amazon EMR. Перенести существующий локальный Hive metastore в Amazon EMR. Использовать AWS Glue Data Catalog для хранения каталога данных компании в качестве внешнего каталога данных..
Почему это правильный ответ
Правильный ответ — использование AWS Glue Data Catalog. AWS Glue Data Catalog — это полностью управляемый, бессерверный сервис, который служит центральным хранилищем метаданных для всех данных в AWS, включая данные, обрабатываемые Amazon EMR. Он позволяет легко интегрировать существующие метаданные Apache Hive, обеспечивая экономически эффективное и бессерверное решение. Неправильные варианты: Миграция Hive metastore в Amazon S3 с последующим сканированием AWS Glue Data Catalog не является прямым способом миграции метаданных Hive. S3 предназначен для хранения объектов, а не для реляционных метаданных. Использование Amazon Aurora MySQL для хранения каталога данных компании, хотя и является управляемой базой данных, не является бессерверным решением и может быть дороже, чем AWS Glue Data Catalog, который специально разработан для этой цели. Настройка нового Hive metastore в Amazon EMR и использование его в качестве каталога данных компании не соответствует требованию бессерверности, так как EMR-кластеры не являются бессерверными, и это не обеспечивает централизованное хранилище метаданных, как AWS Glue Data Catalog.
Сдайте экзамен — без бесконечного поиска ответов
Получите все проверенные вопросы и объяснения для этого экзамена в одном месте и сэкономьте часы подготовки. 1000+ сертификаций · 20+ языков · начните бесплатно.
Сдайте экзамен быстрее → Карта не требуется