GoogleGoogle Professional Data Engineer (PDE) Certification
·TW
·更新於 21 Aug 2026
有兩個大型資料表 sales_transaction_header 和 sales_transaction_line,它們緊密耦合、載入後不可變動,且經常進行聯結。為了最佳化分析效能,您應該如何在 BigQuery 中建立模型?
選擇一個答案
點擊一個選項來檢查您的答案。
正確答案: 建立一個 sales_transaction 資料表,其中包含 sales_transaction_header 資訊作為資料列,並將 sales_transaction_line 資料列作為巢狀和重複欄位。.
為什麼這是答案
正確答案是將 salestransactionline 作為巢狀和重複欄位整合到 salestransactionheader 資料表中。BigQuery 針對巢狀和重複欄位進行了最佳化,這能有效儲存緊密耦合且經常聯結的資料,減少查詢時的資料掃描量和聯結操作,從而顯著提升分析效能。
將 salestransactionheader 資料重複到每個 salestransactionline 資料列會導致資料冗餘和儲存成本增加。將資料儲存為 JSON 類型會增加查詢複雜度,並可能降低效能,因為 BigQuery 需要解析 JSON 內容。建立單獨的資料表並在 WHERE 子句中優先指定 salestransactionline 雖然是常見的關聯式資料庫做法,但在 BigQuery 中,對於這種緊密耦合的資料,巢狀和重複欄位通常能提供更好的效能。
通過考試 — 無需無休止地尋找答案
集中一處獲取此考試的所有核實題目和解釋,節省數小時的準備時間。1,000 多種認證 · 20 多種語言 · 免費開始。
更快通過您的考試 →
無需信用卡