AmazonAmazon AI Practitioner AIF-C01 Certification
·CN
·更新于 31 Jul 2026
一家公司正在比较用于文本摘要任务的大型语言模型,需要一个指标来评估摘要质量。哪种指标是合适的?
选择一个答案
点击一个选项来检查您的答案。
正确答案: Recall-Oriented Understudy for Gisting Evaluation (ROUGE).
为什么这是答案
ROUGE(Recall-Oriented Understudy for Gisting Evaluation)是一种专门用于评估文本摘要和机器翻译质量的指标。它通过比较机器生成的摘要与人工参考摘要之间的重叠词语、短语或句子来衡量摘要的质量,特别关注召回率(即参考摘要中有多少内容被机器摘要捕获)。
Recall(召回率)是衡量模型识别出所有相关实例能力的指标,但单独的召回率不足以评估摘要质量,因为它不考虑摘要的冗余或不相关信息。AUC(ROC曲线下面积)主要用于分类任务中评估模型的区分能力,与摘要质量评估无关。MSE(均方误差)用于回归任务,衡量预测值与真实值之间的平均平方差,不适用于文本摘要。
通过考试 — 无需无休止地寻找答案
将本次考试的所有验证问题和解释集中在一处,节省数小时的准备时间。1,000+ 认证 · 20+ 语言 · 免费开始。
更快通过考试 →
无需银行卡