Una empresa utiliza Amazon SageMaker para producir resúmenes de artículos en varios idiomas y necesita una métrica para evaluar la calidad de los resúmenes traducidos entre idiomas. ¿Qué métrica de evaluación deberían usar?
Elige una respuesta
Toca una opción para verificar tu respuesta.
Respuesta correcta: Bilingual Evaluation Understudy (BLEU).
Por qué esta es la respuesta
BLEU (Bilingual Evaluation Understudy) es la métrica más adecuada para evaluar la calidad de los resúmenes traducidos entre idiomas. Compara el resumen generado con uno o varios resúmenes de referencia escritos por humanos, calculando la superposición de n-gramas. Esto es crucial para la evaluación de la traducción automática, ya que mide la fluidez y la adecuación de la traducción. ROUGE se utiliza principalmente para la evaluación de resúmenes monolingües, comparando un resumen generado con uno o varios de referencia. AUC se usa para evaluar el rendimiento de clasificadores binarios, y Precision es una métrica de clasificación que mide la proporción de predicciones positivas correctas.
Aprueba tu examen — sin la interminable búsqueda de respuestas
Obtén todas las preguntas y explicaciones verificadas para este examen en un solo lugar, y ahorra horas de preparación. Más de 1,000 certificaciones · Más de 20 idiomas · Empieza gratis.
Aprueba tu examen más rápido → No se requiere tarjeta