AmazonAmazon Data Engineer Associate DEA-C01 Certification
·CN
·更新于 2 Aug 2026
您必须构建一个 ETL 管道,该管道每 15 分钟从 10 个源系统摄取文件(CSV、JSON 或 Parquet)到 10 个 Amazon Redshift 表中。所有文件都存储在单个 S3 存储桶中;文件大小从 10 MB 到 20 GB 不等。该管道必须能够容忍架构更改。哪些解决方案符合这些要求?(选择两项。)
选择一个答案
点击一个选项来检查您的答案。
正确答案: 使用 Amazon EventBridge 规则每 15 分钟调用一次 AWS Glue 工作流作业。配置 AWS Glue 工作流,使其具有按需触发器,该触发器运行 AWS Glue crawler,然后在 crawler 成功运行完成后运行 AWS Glue 作业。配置 AWS Glue 作业以处理数据并将其加载到 Amazon Redshift 表中。, 配置 AWS Lambda 函数,以便在文件加载到 S3 存储桶时调用 AWS Glue 工作流。配置 AWS Glue 工作流,使其具有按需触发器,该触发器运行 AWS Glue crawler,然后在 crawler 成功运行完成后运行 AWS Glue 作业。配置 AWS Glue 作业以处理数据并将其加载到 Amazon Redshift 表中。.
为什么这是答案
这两个正确选项都利用了 AWS Glue 工作流来协调数据处理,这对于处理架构更改至关重要。AWS Glue crawler 能够自动检测和更新数据模式,从而适应文件格式和内容的变化。工作流中的按需触发器确保了 crawler 在每次 ETL 运行前更新元数据,然后才执行 Glue 作业将数据加载到 Amazon Redshift。第一个正确选项通过 Amazon EventBridge 规则实现定时触发,满足了每15分钟运行一次的要求。第二个正确选项通过 S3 事件触发 Lambda 函数来启动工作流,适用于文件到达时立即处理的场景。第一个不正确的选项没有使用工作流和 crawler 的组合,难以应对架构变化。其他不正确的选项要么复杂化了流程,要么引入了不必要的组件,不符合简洁高效的原则。
通过考试 — 无需无休止地寻找答案
将本次考试的所有验证问题和解释集中在一处,节省数小时的准备时间。1,000+ 认证 · 20+ 语言 · 免费开始。
更快通过考试 →
无需银行卡