Ein Unternehmen hat ein generatives Textzusammenfassungsmodell mit Amazon Bedrock erstellt und möchte die automatische Modellevaluierung von Bedrock nutzen, um die Genauigkeit des Modells zu messen. Welche Bewertungsmetrik ist am besten geeignet, um die Qualität der generierten Zusammenfassungen zu beurteilen?
Wählen Sie eine Antwort
Tippen Sie auf eine Option, um Ihre Antwort zu überprüfen.
Richtige Antwort: BERTScore.
Warum dies die Antwort ist
BERTScore ist die am besten geeignete Metrik, da es die semantische Ähnlichkeit zwischen der generierten Zusammenfassung und einer Referenzzusammenfassung bewertet. Es nutzt kontextualisierte Einbettungen von BERT, um die Qualität der Zusammenfassung genauer zu erfassen als traditionelle Metriken, die sich auf exakte Wortübereinstimmungen konzentrieren. Die Fläche unter der ROC-Kurve (AUC) und der F1-Score sind Metriken für Klassifizierungsaufgaben, nicht für die Bewertung von Textzusammenfassungen. Der Real World Knowledge (RWK) Score ist keine standardisierte oder weit verbreitete Metrik für die automatische Bewertung von Textzusammenfassungen in Bedrock.
Bestehen Sie Ihre Prüfung – ohne endlose Antwortsuche
Erhalten Sie jede verifizierte Frage und Erklärung für diese Prüfung an einem Ort und sparen Sie Stunden der Vorbereitung. Über 1.000 Zertifizierungen · Über 20 Sprachen · Kostenloser Start.
Bestehen Sie Ihre Prüfung schneller → Keine Karte erforderlich