Je hebt een HDFS data lake gemigreerd naar Cloud Storage. Data scientists moeten Apache Spark en SQL uitvoeren met beveiliging op kolomniveau, in een kosteneffectieve oplossing die schaalt naar een data mesh. Wat bouw je?
Kies een antwoord
Tik op een optie om je antwoord te controleren.
Correct antwoord: 1. Definieer BigLake-tabellen over de Cloud Storage-data. 2. Creëer een Data Catalog-taxonomie van beleidstags. 3. Pas beleidstags toe op kolommen. 4. Verwerk met de Spark–BigQuery-connector of BigQuery SQL..
Waarom dit het antwoord is
De correcte optie biedt een kosteneffectieve, schaalbare oplossing met kolomniveau beveiliging. BigLake-tabellen over Cloud Storage maken het mogelijk om data in Cloud Storage te bevragen met BigQuery, wat kosteneffectief is omdat de data niet verplaatst hoeft te worden. Data Catalog beleidstags bieden fijne-grained beveiliging op kolomniveau. BigQuery en de Spark-BigQuery-connector ondersteunen beide deze functionaliteit en schalen goed voor een data mesh. De andere opties zijn minder optimaal: Dataproc-clusters met Hive en Ranger zijn minder kosteneffectief vanwege de langlopende clusters en de operationele overhead van Ranger. Het laden van data in native BigQuery-tabellen is duurder dan het gebruik van BigLake, omdat de data wordt gedupliceerd. IAM op bestandsniveau in Cloud Storage biedt geen kolomniveau beveiliging en externe BigQuery-tabellen alleen bieden geen kolomniveau beveiliging via beleidstags.
Slaag voor je examen — zonder eindeloos zoeken naar antwoorden
Krijg elke geverifieerde vraag en uitleg voor dit examen op één plek, en bespaar uren voorbereiding. Meer dan 1.000 certificeringen · Meer dan 20 talen · gratis om te beginnen.
Slaag sneller voor je examen → Geen kaart nodig