一位数据科学家使用 SageMaker 训练并部署了一个贷款违约预测模型。训练是通过手动提取数据并在 SageMaker Studio notebook 中运行步骤完成的。预测准确性随时间推移而下降。以下哪种步骤组合是保持模型准确性最具有操作效率的方法?(选择两项)
选择一个答案
点击一个选项来检查您的答案。
正确答案: 使用 SageMaker Pipelines 构建一个自动化工作流,用于提取新数据、重新训练模型并部署新的模型版本。, 使用准确性阈值配置 SageMaker Model Monitor,并在超过该阈值时创建 CloudWatch 警报。将警报链接到 SageMaker Pipelines 工作流以触发自动重新训练。.
为什么这是答案
模型准确性随时间下降是模型漂移的典型表现。最操作效率高的方法是自动化模型的监控和再训练。 SageMaker Pipelines 允许构建端到端的自动化机器学习工作流,包括数据提取、模型训练和部署,这直接解决了手动过程效率低下的问题,并确保了模型更新的及时性。 SageMaker Model Monitor 可以持续监控生产模型的性能,包括数据质量、模型偏差和模型漂移。通过配置准确性阈值和 CloudWatch 警报,可以在模型性能下降时自动触发 SageMaker Pipelines 工作流进行再训练和部署,从而实现智能化的模型维护。 将预测存储在 S3 并使用 SageMaker Processing 作业评估准确性,虽然能发现问题,但缺乏自动化再训练和部署的能力,效率较低。手动重新运行 notebook 效率最低,且无法应对模型漂移的实时性要求。将 notebook 代码导出为 ECS 任务并通过 Lambda 触发,虽然实现了自动化,但相比 SageMaker Pipelines,它缺少专门为 ML 工作流设计的集成和管理能力,操作效率和维护成本可能更高。
通过考试 — 无需无休止地寻找答案
将本次考试的所有验证问题和解释集中在一处,节省数小时的准备时间。1,000+ 认证 · 20+ 语言 · 免费开始。
更快通过考试 → 无需银行卡