Migrowano jezioro danych HDFS do Cloud Storage. Naukowcy zajmujący się danymi muszą uruchamiać Apache Spark i SQL z zabezpieczeniami na poziomie kolumn, w ekonomicznym rozwiązaniu, które skaluje się do siatki danych. Co zbudujesz?
Wybierz odpowiedź
Dotknij opcji, aby sprawdzić swoją odpowiedź.
Poprawna odpowiedź: 1. Zdefiniuj tabele BigLake dla danych Cloud Storage. 2. Utwórz taksonomię Data Catalog dla tagów zasad. 3. Zastosuj tagi zasad do kolumn. 4. Przetwarzaj za pomocą konektora Spark–BigQuery lub BigQuery SQL..
Dlaczego to jest odpowiedź
Poprawna odpowiedź wykorzystuje tabele BigLake, które umożliwiają uruchamianie Apache Spark i SQL bezpośrednio na danych w Cloud Storage, zapewniając jednocześnie bezpieczeństwo na poziomie kolumn. Integracja z Data Catalog i tagami zasad pozwala na precyzyjne zarządzanie dostępem do danych. Przetwarzanie za pomocą konektora Spark–BigQuery lub BigQuery SQL jest ekonomiczne i skalowalne. Pierwsza opcja, choć używa Dataproc, wymagałaby zarządzania długo działającymi klastrami i Rangerem, co jest mniej ekonomiczne i bardziej złożone niż BigLake. Trzecia opcja, ładowanie danych do natywnych tabel BigQuery, wiązałoby się z dodatkowymi kosztami przechowywania i duplikacją danych. Czwarta opcja, stosowanie IAM na poziomie plików, nie zapewnia bezpieczeństwa na poziomie kolumn, a tabele zewnętrzne BigQuery nie oferują tej samej funkcjonalności bezpieczeństwa co BigLake.
Zdaj egzamin — bez niekończącego się szukania odpowiedzi
Uzyskaj wszystkie zweryfikowane pytania i wyjaśnienia do tego egzaminu w jednym miejscu i zaoszczędź godziny przygotowań. Ponad 1000 certyfikacji · Ponad 20 języków · Zacznij za darmo.
Zdaj egzamin szybciej → Karta nie jest wymagana