一位机器学习工程师正在构建一个欺诈检测模型。数据源包括S3中的交易日志和客户资料,以及来自本地MySQL数据库的表。哪种AWS服务或功能可以集中聚合这些不同的数据源以用于机器学习?
选择一个答案
点击一个选项来检查您的答案。
正确答案: 使用AWS Lake Formation集中管理和聚合来自不同源的数据。.
为什么这是答案
AWS Lake Formation 是一种服务,可以帮助您在数天内构建安全的数据湖。它允许您从各种来源(包括 S3 和本地数据库)摄取、清理、转换和编目数据,然后集中管理这些数据的访问和安全。这使其成为聚合不同数据源以用于机器学习的理想选择。 运行 Amazon EMR Spark 作业可以处理和聚合数据,但它不是一个专门用于集中管理和编目不同数据源的服务。Amazon Kinesis Data Streams 主要用于实时数据流处理,不适用于聚合静态或批量数据。将数据存储和聚合在 Amazon DynamoDB 中不适合大规模数据湖场景,因为它是一个 NoSQL 数据库,更适合键值或文档存储,而不是作为数据湖的中央聚合层。
通过考试 — 无需无休止地寻找答案
将本次考试的所有验证问题和解释集中在一处,节省数小时的准备时间。1,000+ 认证 · 20+ 语言 · 免费开始。
更快通过考试 → 无需银行卡