一家公司正在构建一个AI瑜伽教练,该教练必须统计班级中的学生人数,并通过测量肢体位置和角度来判断学生是否正确地完成了伸展动作。使用SageMaker从课堂视频中提取帧,哪两种计算机视觉模型类型结合起来实现这些功能所需的工作量最少?(选择两项)
选择一个答案
点击一个选项来检查您的答案。
正确答案: Object detection, Pose estimation.
为什么这是答案
对象检测(Object detection)模型可以识别并定位图像中的特定对象,例如课堂中的学生。这使得统计学生人数成为可能。姿态估计(Pose estimation)模型则能够识别人体关键点(如关节位置),并根据这些点来推断身体姿态和肢体角度。这对于判断学生是否正确完成瑜伽伸展动作至关重要。结合这两种模型,可以高效地实现题目中描述的功能。 图像分类(Image classification)只能识别图像的整体内容,无法定位或分析个体姿态。光学字符识别(OCR)用于识别文本,与此场景无关。图像生成对抗网络(GANs)用于生成图像,并非分析现有图像。
通过考试 — 无需无休止地寻找答案
将本次考试的所有验证问题和解释集中在一处,节省数小时的准备时间。1,000+ 认证 · 20+ 语言 · 免费开始。
更快通过考试 → 无需银行卡