您需要一個 Apache Beam pipeline,它會使用來自 BigQuery 的小型靜態參考資料(可放入 worker 記憶體中)來豐富 Cloud Pub/Sub 訊息,並將豐富後的資料列寫入 BigQuery。您應該使用哪種 job 類型和轉換?
選擇一個答案
點擊一個選項來檢查您的答案。
正確答案: Streaming job, PubSubIO, BigQueryIO, side-inputs.
為什麼這是答案
此情境涉及處理來自 Cloud Pub/Sub 的即時資料流,因此需要一個串流作業 (Streaming job)。PubSubIO 用於讀取 Pub/Sub 訊息,而 BigQueryIO 用於將處理後的資料寫入 BigQuery。由於參考資料是靜態且可放入 worker 記憶體中,最有效率的方法是使用側邊輸入 (side-inputs) 將這些資料預載入到 Beam pipeline 中,以便在處理每個 Pub/Sub 訊息時進行查詢和豐富。 Batch job 不適用於即時資料流處理。JdbcIO 用於與 JDBC 相容的資料庫互動,而非 BigQuery。側邊輸出 (side-outputs) 用於將元素路由到多個 PCollection,而不是將參考資料引入 pipeline。
通過考試 — 無需無休止地尋找答案
集中一處獲取此考試的所有核實題目和解釋,節省數小時的準備時間。1,000 多種認證 · 20 多種語言 · 免費開始。
更快通過您的考試 → 無需信用卡