Ein Unternehmen vergleicht große Sprachmodelle für eine Textzusammenfassungsaufgabe und benötigt eine Metrik zur Bewertung der Zusammenfassungsqualität. Welche Metrik ist geeignet?
Wählen Sie eine Antwort
Tippen Sie auf eine Option, um Ihre Antwort zu überprüfen.
Richtige Antwort: Recall-Oriented Understudy for Gisting Evaluation (ROUGE).
Warum dies die Antwort ist
ROUGE (Recall-Oriented Understudy for Gisting Evaluation) ist eine Metrik, die speziell zur Bewertung der Qualität von Textzusammenfassungen entwickelt wurde. Sie vergleicht die generierte Zusammenfassung mit einer oder mehreren Referenzzusammenfassungen, indem sie die Überlappung von N-Grammen (Wortfolgen) misst. Ein höherer ROUGE-Wert deutet auf eine bessere Übereinstimmung mit den Referenzzusammenfassungen und somit auf eine höhere Qualität der Zusammenfassung hin. Recall und AUC sind Metriken, die typischerweise für Klassifikationsaufgaben verwendet werden, um die Leistung eines Modells bei der Identifizierung positiver Instanzen zu bewerten, nicht aber die Qualität von generiertem Text. MSE (Mittlere quadratische Abweichung) ist eine Metrik zur Bewertung der Differenz zwischen vorhergesagten und tatsächlichen numerischen Werten und wird häufig in Regressionsaufgaben eingesetzt, nicht für die Bewertung von Textzusammenfassungen.
Bestehen Sie Ihre Prüfung – ohne endlose Antwortsuche
Erhalten Sie jede verifizierte Frage und Erklärung für diese Prüfung an einem Ort und sparen Sie Stunden der Vorbereitung. Über 1.000 Zertifizierungen · Über 20 Sprachen · Kostenloser Start.
Bestehen Sie Ihre Prüfung schneller → Keine Karte erforderlich