正确答案: 将数据迁移到使用S3 Intelligent-Tiering存储类的Amazon S3存储桶。在每月作业开始之前,创建一个Amazon FSx for Lustre文件系统,该文件系统使用延迟加载从S3公开数据。使用该FSx文件系统作为作业的共享存储,然后在作业完成后删除该FSx文件系统。.
为什么这是答案
正确答案通过将不常访问的数据存储在成本效益高的S3 Intelligent-Tiering中,并在需要时利用FSx for Lustre的按需高性能文件系统特性,实现了最大的成本节约和高性能。FSx for Lustre与S3的集成允许延迟加载,这意味着只有作业实际需要的数据才会被加载到文件系统中,进一步优化了成本和启动时间。作业完成后删除FSx文件系统,避免了持续的资源成本。
将数据迁移到启用Multi-Attach的EBS卷不适合共享文件系统场景,因为EBS卷通常设计为附加到单个实例,即使Multi-Attach也有限制,并且不提供传统共享文件系统的语义。将数据迁移到S3 Standard并执行批量加载会产生不必要的S3访问成本,并且批量加载所有200TB数据会显著增加作业启动时间。使用AWS Storage Gateway文件网关会引入额外的网关实例和管理开销,并且其性能可能无法满足数据密集型作业的需求,成本效益也低于FSx for Lustre。