AmazonAmazon ML Engineer Associate MLA-C01 Certification
·CN
·更新于 4 Aug 2026
VideoAI 将 40 TB 的原始视频帧存储在 S3 中,并在仅具有 1 TB 实例存储的 GPU 实例上进行训练。他们的训练循环会按顺序读取数据集多个 epoch,并且可以从兼容 stdin 的接口流式传输记录。他们应该选择哪种 SageMaker 输入模式以及为什么?
选择一个答案
点击一个选项来检查您的答案。
正确答案: 选择 Pipe 模式 (InputMode='Pipe'),以便训练容器可以直接从 S3 流式传输数据,而无需将整个数据集暂存到本地磁盘。当数据集大小超过实例存储且算法支持顺序流式传输时,首选 Pipe 模式。.
为什么这是答案
正确答案是选择 Pipe 模式。Pipe 模式允许训练容器直接从 S3 流式传输数据,无需将整个 40 TB 数据集下载到仅有 1 TB 实例存储的 GPU 实例本地磁盘。这在数据集远大于实例存储且算法支持顺序读取(如本例中的“按顺序读取数据集多个 epoch”)时是理想选择。
选择 File 模式不合适,因为 SageMaker 不会自动扩展实例磁盘以适应超出实例存储的数据集,且将 40 TB 数据下载到 1 TB 存储的实例上是不可行的。将 EBSVolumeSize 设置为 50 TB 虽能提供足够存储,但会增加成本和启动时间,且 Pipe 模式本身就能解决流式传输问题,无需额外持久化。在容器中将 S3 挂载为 POSIX 文件系统并非 SageMaker 的标准输入模式,且可能引入额外的复杂性和开销,不符合最佳实践。
通过考试 — 无需无休止地寻找答案
将本次考试的所有验证问题和解释集中在一处,节省数小时的准备时间。1,000+ 认证 · 20+ 语言 · 免费开始。
更快通过考试 →
无需银行卡