AmazonAmazon AWS Certified Solutions Architect – Associate (SAA-C03)
·CN
·更新于 19 Jul 2026
某公司在 Amazon S3 存储桶中有 10 TB Apache Parquet 格式的日志文件,并且偶尔需要对这些文件运行 SQL 查询。哪种解决方案成本效益最高?
选择一个答案
点击一个选项来检查您的答案。
正确答案: 创建 AWS Glue crawler 以存储和检索 S3 存储桶中的表元数据。使用 Amazon Athena 直接对 S3 存储桶中的数据运行 SQL 语句。.
为什么这是答案
正确答案是使用 AWS Glue crawler 和 Amazon Athena。Athena 是一种交互式查询服务,可以直接查询 Amazon S3 中的数据,支持 Parquet 等多种格式,并且按查询的数据量付费,非常适合偶尔运行 SQL 查询的场景,具有高成本效益。AWS Glue crawler 负责自动发现数据模式并创建元数据表,供 Athena 使用。
A. 创建 Amazon Aurora MySQL 数据库并将数据迁移进去成本较高,且不适合直接查询 S3 中的海量日志文件,每次查询前都需要数据迁移。
B. 创建 Amazon Redshift 集群并使用 Redshift Spectrum 也可以查询 S3 中的数据,但 Redshift 集群本身需要持续运行,会产生固定成本,对于“偶尔需要”的查询场景,成本效益不如 Athena。
D. 创建 Amazon EMR 集群并使用 Apache Spark SQL 也能查询 S3 中的数据,但 EMR 集群的启动和维护成本较高,同样不适合偶尔查询的需求。
通过考试 — 无需无休止地寻找答案
将本次考试的所有验证问题和解释集中在一处,节省数小时的准备时间。1,000+ 认证 · 20+ 语言 · 免费开始。
更快通过考试 →
无需银行卡