Je hebt een kosteneffectieve analyseomgeving nodig zodat data scientists ORC-bestanden met Hive-achtige partitionering kunnen bevragen met SQL, zonder de on-prem Hive te beïnvloeden. Wat moet je doen?
Kies een antwoord
Tik op een optie om je antwoord te controleren.
Correct antwoord: Kopieer de ORC-bestanden naar Cloud Storage en maak vervolgens externe BigQuery-tabellen voor het data scientist-team..
Waarom dit het antwoord is
De juiste aanpak is om de ORC-bestanden naar Cloud Storage te kopiëren en vervolgens externe BigQuery-tabellen te maken. Dit is kosteneffectief omdat BigQuery serverloos is en alleen betaalt voor de data die wordt opgeslagen en opgevraagd. Externe tabellen stellen data scientists in staat om SQL te gebruiken om rechtstreeks query's uit te voeren op de ORC-bestanden in Cloud Storage, zonder de on-prem Hive-omgeving te beïnvloeden. Bigtable is een NoSQL-database en niet geschikt voor SQL-query's op ORC-bestanden. Het importeren van ORC-bestanden naar BigQuery-tabellen zou betekenen dat de data wordt geconverteerd en opgeslagen in BigQuery's eigen formaat, wat extra kosten en complexiteit met zich meebrengt. Een Dataproc-cluster is een optie, maar is minder kosteneffectief dan externe BigQuery-tabellen, omdat een cluster continu draait en beheerd moet worden.
Slaag voor je examen — zonder eindeloos zoeken naar antwoorden
Krijg elke geverifieerde vraag en uitleg voor dit examen op één plek, en bespaar uren voorbereiding. Meer dan 1.000 certificeringen · Meer dan 20 talen · gratis om te beginnen.
Slaag sneller voor je examen → Geen kaart nodig