Une entreprise utilise Amazon SageMaker pour produire des résumés d'articles en plusieurs langues et a besoin d'une métrique pour évaluer la qualité des résumés traduits dans différentes langues. Quelle métrique d'évaluation devrait-elle utiliser ?
Choisissez une réponse
Appuyez sur une option pour vérifier votre réponse.
Bonne réponse : Bilingual Evaluation Understudy (BLEU).
Pourquoi c'est la réponse
BLEU (Bilingual Evaluation Understudy) est la métrique standard pour évaluer la qualité de la traduction automatique, y compris les résumés traduits. Elle compare les n-grammes du texte traduit avec ceux d'une ou plusieurs traductions de référence, mesurant la précision et la fluidité. ROUGE (Recall-Oriented Understudy for Gisting Evaluation) est principalement utilisé pour l'évaluation de la génération de résumés monolingues, se concentrant sur le rappel des informations clés. AUC (Area Under the ROC Curve) est une métrique pour les modèles de classification binaire, mesurant leur capacité à distinguer les classes. La Précision est une métrique de classification qui indique la proportion de prédictions positives correctes parmi toutes les prédictions positives, et n'est pas adaptée pour évaluer la qualité de la traduction.
Réussissez votre examen — sans la chasse aux réponses interminable
Obtenez toutes les questions et explications vérifiées pour cet examen en un seul endroit, et économisez des heures de préparation. Plus de 1 000 certifications · Plus de 20 langues · Gratuit pour commencer.
Réussissez votre examen plus rapidement → Pas de carte requise