某個 Dataflow 工作會將時間序列指標彙總並寫入 Bigtable,但寫入速度很慢,而且許多資訊主頁使用者需要更新鮮的資料。哪兩項操作可以改善寫入延遲和並行?
選擇一個答案
點擊一個選項來檢查您的答案。
正確答案: 增加 Dataflow worker 的最大數量 (設定 maxNumWorkers)。, 將節點新增至 Bigtable 叢集。.
為什麼這是答案
增加 Dataflow worker 的最大數量 (設定 maxNumWorkers) 可以提高 Dataflow 管線的平行處理能力,讓更多資料同時被處理並寫入 Bigtable,從而改善寫入延遲。將節點新增至 Bigtable 叢集則能增加 Bigtable 的吞吐量和儲存容量,使其能夠處理更高的寫入負載,進一步降低延遲並提升並行處理能力。 以本機執行模式執行 Dataflow 管線不適用於生產環境,且無法解決大規模資料寫入的延遲問題。在寫入 Bigtable 之前套用 Flatten 或 CoGroupByKey 轉換,通常是為了資料結構的調整或聚合,而非直接改善寫入延遲或並行。Flatten 轉換會將多個 PCollection 合併為一個,而 CoGroupByKey 則用於根據鍵將多個 PCollection 中的元素進行分組,這些操作本身可能會增加處理時間,而非減少寫入延遲。
通過考試 — 無需無休止地尋找答案
集中一處獲取此考試的所有核實題目和解釋,節省數小時的準備時間。1,000 多種認證 · 20 多種語言 · 免費開始。
更快通過您的考試 → 無需信用卡