Uma empresa usa o Amazon SageMaker para produzir resumos de artigos em vários idiomas e precisa de uma métrica para avaliar a qualidade dos resumos traduzidos entre os idiomas. Qual métrica de avaliação eles devem usar?
Escolha uma resposta
Toque em uma opção para verificar sua resposta.
Resposta correta: Bilingual Evaluation Understudy (BLEU).
Por que esta é a resposta
A métrica BLEU (Bilingual Evaluation Understudy) é a mais apropriada para avaliar a qualidade de resumos traduzidos. Ela compara a sobreposição de n-gramas entre o texto gerado e um ou mais textos de referência, sendo amplamente utilizada e eficaz para tarefas de tradução automática e sumarização multilíngue. ROUGE (Recall-Oriented Understudy for Gisting Evaluation) é mais adequada para avaliar a qualidade de sumarização de texto monolíngue, focando na cobertura de informações do resumo em relação ao original, e não na tradução. AUC (Area Under the ROC Curve) é uma métrica para classificador binário, medindo a capacidade de distinguir entre classes, não sendo relevante para avaliação de texto. Precisão, embora seja uma métrica fundamental em muitas áreas, isoladamente não captura a fluidez ou a semelhança de significado necessária para avaliar a qualidade de uma tradução ou resumo.
Passe no seu exame — sem a busca interminável por respostas
Obtenha todas as perguntas e explicações verificadas para este exame em um só lugar e economize horas de preparação. Mais de 1.000 certificações · Mais de 20 idiomas · Grátis para começar.
Passe no seu exame mais rápido → Não é necessário cartão