GoogleGoogle Professional Data Engineer (PDE) Certification·NL·Bijgewerkt 21 Aug 2026
Je ontvangt CSV-dumps voor boekingen en gebruikersprofielen in Cloud Storage en moet het e-mailveld in beide datasets de-identificeren, zodat analisten kunnen joinen op e-mail zonder toegang te krijgen tot PII. Wat moet je doen voordat je de gegevens in BigQuery laadt?
Kies een antwoord
Tik op een optie om je antwoord te controleren.
Correct antwoord: 1. Creëer een pipeline om het e-mailveld te de-identificeren met behulp van recordTransformations in Cloud DLP met format-preserving encryption met FFX als het de-identificatietransformatie type. 2. Laad de boekings- en gebruikersprofielgegevens in een BigQuery-tabel..
Waarom dit het antwoord is
De correcte optie gebruikt Cloud DLP met format-preserving encryption (FPE) met FFX om het e-mailveld te de-identificeren. FPE behoudt het formaat van de originele gegevens, wat essentieel is om te kunnen joinen op het e-mailveld zonder toegang tot PII. FFX is een specifiek algoritme voor FPE dat hiervoor geschikt is. Masking (optie 1) zou de e-mailadressen onbruikbaar maken voor joins. Dynamische data masking in BigQuery (opties 3 en 4) is een post-load oplossing die de originele PII in BigQuery opslaat en maskeert bij query's, wat niet voldoet aan de vereiste om de gegevens voor het laden te de-identificeren. Bovendien zou het joinen op gemaskerde waarden niet werken zoals verwacht.
Slaag voor je examen — zonder eindeloos zoeken naar antwoorden
Krijg elke geverifieerde vraag en uitleg voor dit examen op één plek, en bespaar uren voorbereiding. Meer dan 1.000 certificeringen · Meer dan 20 talen · gratis om te beginnen.