AmazonAmazon ML Engineer Associate MLA-C01 Certification
·CN
·更新于 4 Aug 2026
某公司需要一种无代码的方式,通过对某些列应用独热编码来转换 Amazon S3 中的大型 Parquet 数据集,并将转换后的数据写回同一个 S3 存储桶。哪种解决方案符合这些限制?
选择一个答案
点击一个选项来检查您的答案。
正确答案: 创建一个 AWS Glue DataBrew 项目,连接到 S3 数据,编写一个 recipe 来对列进行独热编码,然后运行一个作业将输出写回 S3。.
为什么这是答案
AWS Glue DataBrew 是一种无代码的数据准备服务,它允许用户通过可视化界面对数据进行转换。它支持直接从 Amazon S3 读取 Parquet 文件,并提供了独热编码(one-hot encoding)等多种预构建的转换操作。用户可以创建 recipe 来定义转换步骤,然后运行 DataBrew 作业将转换后的数据写回 S3,完全符合无代码和处理大型数据集的要求。
其他选项不符合“无代码”的要求:
Amazon Athena 需要编写 SQL 查询来执行独热编码,这不属于无代码解决方案。
AWS Glue ETL 交互式笔记本需要编写 Python 或 Scala 代码(使用 Apache Spark)来执行独热编码,这也不是无代码解决方案。
Amazon Redshift 集群与 Redshift Spectrum 同样需要编写 SQL 查询来执行独热编码,并且预置 Redshift 集群会增加额外的管理和成本开销,不符合无代码和最简便的要求。
通过考试 — 无需无休止地寻找答案
将本次考试的所有验证问题和解释集中在一处,节省数小时的准备时间。1,000+ 认证 · 20+ 语言 · 免费开始。
更快通过考试 →
无需银行卡