Вы перенесли озеро данных HDFS в Cloud Storage. Специалистам по данным необходимо запускать Apache Spark и SQL с безопасностью на уровне столбцов в экономичном решении, которое масштабируется в data mesh. Что вы будете строить?
Выберите ответ
Нажмите на вариант, чтобы проверить свой ответ.
Правильный ответ: 1. Определить таблицы BigLake поверх данных Cloud Storage. 2. Создать таксономию тегов политик в Data Catalog. 3. Применить теги политик к столбцам. 4. Обрабатывать с помощью коннектора Spark–BigQuery или BigQuery SQL..
Почему это правильный ответ
Правильный ответ — это BigLake с безопасностью на уровне столбцов через Data Catalog. BigLake позволяет анализировать данные в Cloud Storage с помощью BigQuery, обеспечивая при этом детализированный контроль доступа (безопасность на уровне столбцов) с помощью политик тегов Data Catalog. Это экономичное решение, поскольку оно работает непосредственно с данными в Cloud Storage, избегая затрат на перемещение данных, и масштабируется для data mesh. Spark может взаимодействовать с BigQuery через коннектор Spark-BigQuery. Развертывание долгоживущих кластеров Dataproc с Apache Hive и Ranger менее экономично, так как Dataproc — это управляемый сервис, но долгоживущие кластеры увеличивают затраты, а Ranger требует дополнительного управления. Загрузка данных в нативные таблицы BigQuery не является оптимальным решением для озера данных, поскольку это перемещает данные из Cloud Storage, увеличивая затраты и снижая гибкость. Применение IAM на уровне файлов Cloud Storage не обеспечивает безопасность на уровне столбцов, что является ключевым требованием.
Сдайте экзамен — без бесконечного поиска ответов
Получите все проверенные вопросы и объяснения для этого экзамена в одном месте и сэкономьте часы подготовки. 1000+ сертификаций · 20+ языков · начните бесплатно.
Сдайте экзамен быстрее → Карта не требуется