GoogleGoogle Professional Data Engineer (PDE) Certification
·TW
·更新於 21 Aug 2026
您將 HDFS 資料湖遷移到 Cloud Storage。資料科學家需要執行 Apache Spark 和 SQL,並具備欄級安全性,而且解決方案必須符合成本效益,並能擴展成資料網格。您會建構什麼?
選擇一個答案
點擊一個選項來檢查您的答案。
正確答案: 1. 在 Cloud Storage 資料上定義 BigLake 資料表。2. 建立政策標籤的 Data Catalog 分類。3. 將政策標籤套用至欄。4. 使用 Spark–BigQuery 連接器或 BigQuery SQL 進行處理。.
為什麼這是答案
正確答案透過 BigLake 資料表在 Cloud Storage 資料上提供欄級安全性,並支援 Spark 和 SQL 查詢,符合資料科學家的需求。BigLake 允許 BigQuery 直接查詢 Cloud Storage 上的資料,並整合 BigQuery 的精細存取控制(透過 Data Catalog 政策標籤)。這是一個成本效益高且可擴展的解決方案,適用於資料網格。
選項 1 的 Dataproc 叢集雖然支援 Spark 和 Hive SQL,但長時間執行的叢集成本較高,且 Ranger 的欄級安全性管理較為複雜,不符合成本效益和可擴展性要求。
選項 3 將資料載入原生 BigQuery 資料表,這會產生額外的儲存和載入成本,且不符合將 HDFS 資料湖遷移到 Cloud Storage 的初衷,因為資料仍需複製。
選項 4 的 IAM 檔案層級安全性無法提供精細的欄級安全性,且 BigQuery 外部資料表本身不直接提供欄級安全性,需要額外配置。
通過考試 — 無需無休止地尋找答案
集中一處獲取此考試的所有核實題目和解釋,節省數小時的準備時間。1,000 多種認證 · 20 多種語言 · 免費開始。
更快通過您的考試 →
無需信用卡