Una empresa está comparando modelos de lenguaje grandes para una tarea de resumen de texto y necesita una métrica para evaluar la calidad del resumen. ¿Qué métrica es apropiada?
Elige una respuesta
Toca una opción para verificar tu respuesta.
Respuesta correcta: Recall-Oriented Understudy for Gisting Evaluation (ROUGE).
Por qué esta es la respuesta
ROUGE (Recall-Oriented Understudy for Gisting Evaluation) es una métrica estándar utilizada para evaluar la calidad de los resúmenes generados automáticamente comparándolos con resúmenes de referencia creados por humanos. Mide la superposición de unidades como n-gramas, secuencias de palabras o pares de palabras entre el resumen generado y el de referencia, lo que la hace ideal para tareas de resumen de texto. Recall es una mét métrica de clasificación que mide la proporción de positivos reales que se identificaron correctamente, no es adecuada para la evaluación de resúmenes. AUC es una métrica para evaluar el rendimiento de clasificadores binarios. MSE es una métrica para evaluar la precisión de modelos de regresión.
Aprueba tu examen — sin la interminable búsqueda de respuestas
Obtén todas las preguntas y explicaciones verificadas para este examen en un solo lugar, y ahorra horas de preparación. Más de 1,000 certificaciones · Más de 20 idiomas · Empieza gratis.
Aprueba tu examen más rápido → No se requiere tarjeta