Je hebt on-prem Spark-taken die dagelijks Parquet verwerken. Bij de migratie naar Google Cloud wil je beheerde services, minimale ETL-wijzigingen en BigQuery-beschikbaarheid voor toekomstige pipelines. Wat moet je doen?
Kies een antwoord
Tik op een optie om je antwoord te controleren.
Correct antwoord: Migreer data naar Cloud Storage en migreer metadata naar Dataproc Metastore (DPMS). Refactor Spark-taken om Cloud Storage te lezen/schrijven en voer ze uit op Dataproc Serverless..
Waarom dit het antwoord is
Deze optie voldoet aan alle eisen. Data wordt gemigreerd naar Cloud Storage, een beheerde opslagdienst. Dataproc Metastore (DPMS) biedt een beheerde Hive Metastore, essentieel voor Spark-taken die Parquet-bestanden verwerken en metadata nodig hebben. Het refactoren van Spark-taken om Cloud Storage te lezen/schrijven is een minimale aanpassing. Dataproc Serverless is een volledig beheerde dienst voor Spark, wat de operationele overhead minimaliseert. De combinatie van Cloud Storage en DPMS maakt BigQuery-integratie via externe tabellen mogelijk voor toekomstige pipelines. De andere opties zijn minder geschikt: Dataplex beheert data, maar vervangt de Hive Metastore niet direct voor Spark. BigQuery is een datawarehouse en niet de primaire opslag voor Parquet-bestanden die door Spark worden verwerkt, wat een grotere refactoring vereist. BigLake is een engine, geen opslagdienst, en Dataproc on Compute Engine is geen serverless optie.
Slaag voor je examen — zonder eindeloos zoeken naar antwoorden
Krijg elke geverifieerde vraag en uitleg voor dit examen op één plek, en bespaar uren voorbereiding. Meer dan 1.000 certificeringen · Meer dan 20 talen · gratis om te beginnen.
Slaag sneller voor je examen → Geen kaart nodig