Sie benötigen eine Apache Beam Pipeline, die Cloud Pub/Sub-Nachrichten mit kleinen statischen Referenzdaten aus BigQuery (passt in den Worker-Speicher) anreichert und die angereicherten Zeilen in BigQuery schreibt. Welchen Jobtyp und welche Transforms sollten Sie verwenden?
Wählen Sie eine Antwort
Tippen Sie auf eine Option, um Ihre Antwort zu überprüfen.
Richtige Antwort: Streaming-Job, PubSubIO, BigQueryIO, side-inputs.
Warum dies die Antwort ist
Für die Anreicherung von Echtzeitdaten aus Pub/Sub mit statischen Referenzdaten ist ein Streaming-Job erforderlich, da die Daten kontinuierlich verarbeitet werden. PubSubIO ist die korrekte Transform, um Nachrichten aus Cloud Pub/Sub zu lesen. Da die Referenzdaten klein sind und in den Worker-Speicher passen, sind Side-Inputs die effizienteste Methode, um diese Daten einmalig aus BigQuery zu laden und für jede eingehende Nachricht zur Anreicherung zu nutzen. BigQueryIO wird sowohl zum Lesen der Referenzdaten (für Side-Inputs) als auch zum Schreiben der angereicherten Zeilen in BigQuery verwendet. Ein Batch-Job wäre falsch, da er für die Verarbeitung endlicher Datensätze konzipiert ist. JdbcIO ist für relationale Datenbanken gedacht, nicht für BigQuery. Side-outputs sind für die Ausgabe von Datenströmen in verschiedene Senken basierend auf einer Bedingung gedacht, nicht für die Anreicherung.
Bestehen Sie Ihre Prüfung – ohne endlose Antwortsuche
Erhalten Sie jede verifizierte Frage und Erklärung für diese Prüfung an einem Ort und sparen Sie Stunden der Vorbereitung. Über 1.000 Zertifizierungen · Über 20 Sprachen · Kostenloser Start.
Bestehen Sie Ihre Prüfung schneller → Keine Karte erforderlich