Qual métrica de avaliação é comumente usada para avaliar modelos de base (FMs) em tarefas de sumarização de texto?
Escolha uma resposta
Toque em uma opção para verificar sua resposta.
Resposta correta: Pontuação BLEU (Bilingual Evaluation Understudy).
Por que esta é a resposta
A pontuação BLEU é amplamente utilizada para avaliar modelos de linguagem em tarefas de sumarização de texto porque compara a sobreposição de n-gramas entre o texto gerado pelo modelo e um ou mais textos de referência. Isso a torna eficaz para medir a fluência e a adequação da sumarização. A pontuação F1 é mais comum para classificação, avaliando precisão e recall. A acurácia é uma métrica simples de classificação, inadequada para a complexidade da sumarização. O Erro Quadrático Médio (MSE) é usado para regressão, medindo a diferença entre valores previstos e reais, não sendo aplicável à avaliação de texto.
Passe no seu exame — sem a busca interminável por respostas
Obtenha todas as perguntas e explicações verificadas para este exame em um só lugar e economize horas de preparação. Mais de 1.000 certificações · Mais de 20 idiomas · Grátis para começar.
Passe no seu exame mais rápido → Não é necessário cartão