Je moet onbewerkte, ongestructureerde brongegevens exact opslaan zoals ze zijn opgehaald (schema kan veranderen) voor latere herverwerking. Waar moet je de onbewerkte gegevens plaatsen en hoe moeten pipelines deze benaderen?
Kies een antwoord
Tik op een optie om je antwoord te controleren.
Correct antwoord: Sla de gegevens op in een Cloud Storage-bucket. Ontwerp de verwerkingspipelines om de gegevens uit de bucket op te halen..
Waarom dit het antwoord is
De juiste aanpak is om de onbewerkte, ongestructureerde gegevens op te slaan in een Cloud Storage-bucket. Cloud Storage is ideaal voor het opslaan van onbewerkte gegevens van elk formaat en schema, inclusief ongestructureerde gegevens, en biedt hoge duurzaamheid en schaalbaarheid. Dit maakt het geschikt voor "exact zoals opgehaald" opslag en latere herverwerking, zelfs als het schema verandert. Verwerkingspipelines kunnen de gegevens direct uit de bucket halen. Het opslaan van onbewerkte gegevens in een BigQuery-tabel is minder geschikt omdat BigQuery een schemagebonden database is, wat problemen kan opleveren bij het opslaan van ongestructureerde gegevens of gegevens met een veranderend schema. Het doorsturen van gegevens door een verwerkingspipeline voordat ze worden opgeslagen, druist in tegen het vereiste om de onbewerkte gegevens exact op te slaan zoals ze zijn opgehaald voor latere herverwerking.
Slaag voor je examen — zonder eindeloos zoeken naar antwoorden
Krijg elke geverifieerde vraag en uitleg voor dit examen op één plek, en bespaar uren voorbereiding. Meer dan 1.000 certificeringen · Meer dan 20 talen · gratis om te beginnen.
Slaag sneller voor je examen → Geen kaart nodig