Een bedrijf gebruikt Amazon SageMaker om artikelsamenvattingen in verschillende talen te produceren en heeft een metriek nodig om de kwaliteit van vertaalde samenvattingen in verschillende talen te beoordelen. Welke evaluatiemetriek moeten ze gebruiken?
Kies een antwoord
Tik op een optie om je antwoord te controleren.
Correct antwoord: Bilingual Evaluation Understudy (BLEU).
Waarom dit het antwoord is
BLEU (Bilingual Evaluation Understudy) is de meest geschikte metriek voor het evalueren van de kwaliteit van machinaal vertaalde tekst, inclusief samenvattingen. Het vergelijkt de kandidaatvertaling met een of meer referentievertalingen en meet de overeenkomst in n-grammen. Een hogere BLEU-score duidt op een betere vertaalkwaliteit. ROUGE (Recall-Oriented Understudy for Gisting Evaluation) is meer gericht op het evalueren van samenvattingen in één taal, door de overlap met referentiesamenvattingen te meten, en is minder geschikt voor vertaalbeoordeling. AUC (Area Under the ROC Curve) en Precision zijn classificatiemetrieken die worden gebruikt om de prestaties van binaire classificatiemodellen te evalueren en zijn niet relevant voor het beoordelen van vertaalkwaliteit.
Slaag voor je examen — zonder eindeloos zoeken naar antwoorden
Krijg elke geverifieerde vraag en uitleg voor dit examen op één plek, en bespaar uren voorbereiding. Meer dan 1.000 certificeringen · Meer dan 20 talen · gratis om te beginnen.
Slaag sneller voor je examen → Geen kaart nodig