AmazonAmazon ML Engineer Associate MLA-C01 Certification
·TW
·更新於 4 Aug 2026
AdView Inc. 希望建立一個單一的 SageMaker Data Wrangler 流程,將活動日誌的 S3 CSV 檔案與客戶設定檔的 Redshift 表格進行連接,然後將清理後的連接資料集匯出為 Parquet 格式。Redshift 叢集位於私有子網路中。在 Data Wrangler 中實作此功能,同時確保連線和正確性的正確操作順序為何?
選擇一個答案
點擊一個選項來檢查您的答案。
正確答案: 將 S3 CSV 上傳為 Data Wrangler 資料集,並使用 Redshift JDBC 憑證將 Redshift 作為流程中的另一個資料集新增。在流程中新增一個 Join 轉換並指定連接鍵。設定 Data Wrangler 流程處理/匯出在 VPC 中執行,該 VPC 具有允許存取 Redshift 叢集的子網路和安全群組,並確保 Data Wrangler 使用的 IAM 角色具有存取 S3 和 Redshift 憑證的權限。.
為什麼這是答案
正確的選項描述了在 SageMaker Data Wrangler 中連接 S3 和 Redshift 資料的正確步驟。首先,將 S3 CSV 和 Redshift 表格都作為資料集加入 Data Wrangler。然後,使用 Join 轉換來合併這些資料。由於 Redshift 叢集位於私有子網路中,因此必須設定 Data Wrangler 流程在具有適當子網路和安全群組的 VPC 中執行,以確保可以存取 Redshift。最後,Data Wrangler 使用的 IAM 角色需要具備存取 S3 和 Redshift 的權限。
其他選項不正確的原因:
第二個選項錯誤地假設 Data Wrangler 會自動建立 Redshift 資料庫代理並處理 VPC 配置,這是不正確的。
第三個選項建議使用 Glue ETL 進行連接,這繞過了 Data Wrangler 的連接功能,並且不符合在 Data Wrangler 中建立單一流程的要求。
第四個選項錯誤地聲稱 Data Wrangler 會將連接下推到 Redshift,而無需任何網路或憑證變更,這忽略了 Redshift 位於私有子網路中的要求以及存取憑證的必要性。
通過考試 — 無需無休止地尋找答案
集中一處獲取此考試的所有核實題目和解釋,節省數小時的準備時間。1,000 多種認證 · 20 多種語言 · 免費開始。
更快通過您的考試 →
無需信用卡