Hai eseguito la migrazione di un data lake HDFS a Cloud Storage. Gli scienziati dei dati devono eseguire Apache Spark e SQL con sicurezza a livello di colonna, in una soluzione conveniente che si adatti a una data mesh. Cosa crei?
Scegli una risposta
Tocca un'opzione per controllare la tua risposta.
Risposta corretta: 1. Definisci tabelle BigLake sui dati di Cloud Storage. 2. Crea una tassonomia di policy tag in Data Catalog. 3. Applica i policy tag alle colonne. 4. Elabora utilizzando il connettore Spark–BigQuery o BigQuery SQL..
Perché questa è la risposta
L'opzione corretta risponde a tutti i requisiti. Le tabelle BigLake su Cloud Storage consentono di interrogare i dati del data lake con BigQuery, offrendo un'integrazione nativa con la sicurezza a livello di colonna tramite Data Catalog e policy tag. Questo è conveniente e si adatta a una data mesh, consentendo sia Spark che SQL. L'opzione 1 (Dataproc, Hive, Ranger) è costosa per cluster a lunga esecuzione e Ranger è complesso da gestire. L'opzione 3 (tabelle native BigQuery) richiede lo spostamento dei dati, perdendo i vantaggi di un data lake su Cloud Storage. L'opzione 4 (IAM a livello di file) non offre sicurezza a livello di colonna e le tabelle esterne BigQuery non supportano i policy tag per la sicurezza granulare.
Supera il tuo esame — senza l'infinita caccia alle risposte
Ottieni ogni domanda e spiegazione verificata per questo esame in un unico posto, e risparmia ore di preparazione. Oltre 1.000 certificazioni · Oltre 20 lingue · Inizia gratuitamente.
Supera il tuo esame più velocemente → Nessuna carta richiesta