某公司正在 SageMaker 中使用儲存在 S3 上的 200 TB 資料訓練模型。該資料集包含許多檔案,每個檔案都大於 200 MB。該公司希望以最快的處理時間和最少的設定工作量來完成。他們應該使用哪種資料存取方法?
選擇一個答案
點擊一個選項來檢查您的答案。
正確答案: 使用 SageMaker FastFile 模式從 S3 按需串流檔案。.
為什麼這是答案
SageMaker FastFile 模式(現稱為 SageMaker 串流模式)專為處理大型資料集而設計,它會按需從 S3 串流資料,避免了將整個資料集複製到訓練實例的延遲,這對於 200 TB 的資料集至關重要。這種方法能顯著減少啟動時間並優化儲存成本,同時提供高吞吐量。 SageMaker File 模式會將所有資料複製到訓練實例儲存,對於 200 TB 的資料量來說,這會導致極長的複製時間和高昂的儲存成本。Amazon FSx for Lustre 雖然提供高效能,但設定和管理較為複雜,且會增加額外成本。Amazon EFS 的效能通常不足以應付如此大規模的訓練資料,且掛載到訓練實例上仍可能面臨 I/O 瓶頸。
通過考試 — 無需無休止地尋找答案
集中一處獲取此考試的所有核實題目和解釋,節省數小時的準備時間。1,000 多種認證 · 20 多種語言 · 免費開始。
更快通過您的考試 → 無需信用卡