AmazonAmazon AI Practitioner AIF-C01 Certification
·TW
·更新於 31 Jul 2026
某公司正在比較用於文字摘要任務的大型語言模型,需要一個指標來評估摘要品質。哪一個指標是合適的?
選擇一個答案
點擊一個選項來檢查您的答案。
正確答案: Recall-Oriented Understudy for Gisting Evaluation (ROUGE).
為什麼這是答案
ROUGE (Recall-Oriented Understudy for Gisting Evaluation) 是一種專門設計用於評估自動文本摘要和機器翻譯品質的指標。它透過比較機器生成的摘要與人類參考摘要之間的重疊詞彙、詞組或句子來衡量摘要的品質,特別是其內容的完整性(Recall)。
Recall 是一個通用指標,用於衡量模型正確識別正例的能力,但它本身無法全面評估摘要的流暢性或連貫性。AUC (Area Under the ROC Curve) 主要用於評估二元分類模型的性能,不適用於文本摘要。MSE (Mean Squared Error) 則用於衡量回歸模型的預測誤差,與文本摘要的評估無關。
通過考試 — 無需無休止地尋找答案
集中一處獲取此考試的所有核實題目和解釋,節省數小時的準備時間。1,000 多種認證 · 20 多種語言 · 免費開始。
更快通過您的考試 →
無需信用卡