一位数据工程师为 S3 中的对象设置了 AWS Glue Data Catalog,并且需要增量更新。S3 事件通知被发送到 SQS 队列。以下哪种步骤组合能以最少的操作开销提供增量目录更新?(选择两项)
选择一个答案
点击一个选项来检查您的答案。
正确答案: 创建一个基于 S3 事件的 AWS Glue crawler,从 SQS 队列读取事件。, 使用 AWS Lambda 函数根据 SQS 队列接收到的 S3 事件直接更新 Data Catalog。.
为什么这是答案
正确答案是“创建一个基于 S3 事件的 AWS Glue crawler,从 SQS 队列读取事件”和“使用 AWS Lambda 函数根据 SQS 队列接收到的 S3 事件直接更新 Data Catalog”。 选项一:基于 S3 事件的 AWS Glue crawler 可以配置为从 SQS 队列读取 S3 事件,从而实现自动化和增量更新,操作开销较低。 选项三:Lambda 函数可以直接处理 SQS 队列中的 S3 事件,并使用 AWS Glue API 增量更新 Data Catalog,提供高度的灵活性和低操作开销。 选项二:安排 AWS Glue crawler 定期运行会扫描整个 S3 存储桶,而不是仅处理增量更改,这会导致不必要的计算和更高的成本。 选项四:手动触发 crawler 不符合自动化和低操作开销的要求。 选项五:使用 AWS Step Functions 编排虽然可行,但对于简单的增量更新来说,其复杂性和操作开销通常高于直接使用 Lambda 或事件驱动的 crawler。
通过考试 — 无需无休止地寻找答案
将本次考试的所有验证问题和解释集中在一处,节省数小时的准备时间。1,000+ 认证 · 20+ 语言 · 免费开始。
更快通过考试 → 无需银行卡