一個資料科學團隊將儲存許多不同的訓練資料集,並且必須支援自動擴展、成本效益和基於 SQL 的探索。哪種儲存方法最適合此使用案例?
選擇一個答案
點擊一個選項來檢查您的答案。
正確答案: 將資料集儲存為 Amazon S3 中的檔案。.
為什麼這是答案
將資料集儲存為 Amazon S3 中的檔案是最適合的選項。S3 提供了自動擴展的儲存空間,成本效益高,並且可以輕鬆與 Amazon Athena 等服務整合,以進行基於 SQL 的探索,而無需移動資料。將資料集儲存在連接到 EC2 執行個體的 Amazon EBS 磁碟區上,雖然提供持久儲存,但缺乏自動擴展能力,且成本效益不如 S3。將資料集保留為多節點 Amazon Redshift 叢集中的表格,雖然支援 SQL 查詢,但對於原始訓練資料集來說成本較高,且主要用於資料倉儲和分析,而非原始資料儲存。將資料集儲存為 Amazon DynamoDB 中的全域資料表不適合此用例,因為 DynamoDB 是一個 NoSQL 資料庫,不支援基於 SQL 的探索,且主要用於鍵值和文件資料。
通過考試 — 無需無休止地尋找答案
集中一處獲取此考試的所有核實題目和解釋,節省數小時的準備時間。1,000 多種認證 · 20 多種語言 · 免費開始。
更快通過您的考試 → 無需信用卡