Sie müssen rohe, unstrukturierte Quelldaten genau so speichern, wie sie abgerufen wurden (Schema kann sich ändern), um sie später erneut verarbeiten zu können. Wo sollten Sie die Rohdaten ablegen und wie sollten Pipelines darauf zugreifen?
Wählen Sie eine Antwort
Tippen Sie auf eine Option, um Ihre Antwort zu überprüfen.
Richtige Antwort: Speichern Sie die Daten in einem Cloud Storage-Bucket. Entwerfen Sie die Verarbeitungspipelines so, dass sie die Daten aus dem Bucket abrufen..
Warum dies die Antwort ist
Cloud Storage ist ideal für das Speichern von Rohdaten, da es unstrukturierte Daten in jedem Format aufnehmen kann, ohne ein Schema zu erzwingen. Dies ist entscheidend, wenn sich das Schema ändern kann oder unbekannt ist. Pipelines können direkt auf diese Daten zugreifen, um sie bei Bedarf erneut zu verarbeiten. BigQuery ist eine Data-Warehouse-Lösung, die ein definiertes Schema erfordert und für bereits strukturierte oder semistrukturierte Daten optimiert ist, was sie für rohe, unstrukturierte Daten weniger geeignet macht. Das Speichern nur der verarbeiteten Daten verhindert den Zugriff auf die ursprünglichen Rohdaten für eine erneute Verarbeitung, was die Anforderung der Frage nicht erfüllt.
Bestehen Sie Ihre Prüfung – ohne endlose Antwortsuche
Erhalten Sie jede verifizierte Frage und Erklärung für diese Prüfung an einem Ort und sparen Sie Stunden der Vorbereitung. Über 1.000 Zertifizierungen · Über 20 Sprachen · Kostenloser Start.
Bestehen Sie Ihre Prüfung schneller → Keine Karte erforderlich