AmazonAmazon Machine Learning Specialty MLS-C01
·CN
·更新于 26 Jul 2026
一位数据科学家需要探索存储在 Amazon S3 数据湖中约 500 GB 的历史库存数据(CSV 文件)。他们希望使用 SQL 进行探索,并且公司希望最大限度地降低成本和运营开销。哪种方法能以最少的运营管理满足这些要求?
选择一个答案
点击一个选项来检查您的答案。
正确答案: 使用 AWS Glue 抓取 S3 存储桶并填充 AWS Glue Data Catalog,然后使用 Amazon Athena 查询数据。.
为什么这是答案
正确答案是使用 AWS Glue 抓取 S3 存储桶并填充 AWS Glue Data Catalog,然后使用 Amazon Athena 查询数据。这种方法最大限度地降低了运营开销和成本,因为它是一种无服务器解决方案。AWS Glue Data Catalog 自动管理元数据,而 Amazon Athena 允许您直接在 S3 上使用标准 SQL 查询数据,按查询的数据量付费,无需预置或管理任何服务器。
预置 Amazon EMR 集群会产生运营开销和持续成本,因为它需要管理集群。Amazon Redshift 是一种数据仓库解决方案,需要预置和管理集群,即使使用外部表,也比 Athena 产生更高的运营开销和成本。Redshift Spectrum(通过外部 schema 访问 S3 数据)虽然比将数据复制到 Redshift 更灵活,但仍需要管理 Redshift 集群。
通过考试 — 无需无休止地寻找答案
将本次考试的所有验证问题和解释集中在一处,节省数小时的准备时间。1,000+ 认证 · 20+ 语言 · 免费开始。
更快通过考试 →
无需银行卡