Qual é o objetivo da tokenização no processamento de linguagem natural?
Escolha uma resposta
Toque em uma opção para verificar sua resposta.
Resposta correta: Dividir o texto em unidades menores para processamento.
Por que esta é a resposta
A tokenização é o processo de dividir uma sequência de texto em unidades menores, chamadas tokens. Essas unidades podem ser palavras, frases, caracteres ou subpalavras. O objetivo principal é preparar o texto para análise e processamento por modelos de PLN, pois a maioria dos algoritmos não consegue trabalhar diretamente com texto bruto. Ao tokenizar, o modelo consegue entender e processar a estrutura e o significado do texto de forma mais eficiente. As outras opções estão incorretas porque: Criptografar dados textuais é uma função de segurança, não de tokenização. Comprimir arquivos de texto visa reduzir o tamanho do arquivo, não preparar para processamento linguístico. Traduzir texto entre idiomas é uma tarefa de tradução automática, que pode usar tokenização como uma etapa, mas não é o objetivo da tokenização em si.
Passe no seu exame — sem a busca interminável por respostas
Obtenha todas as perguntas e explicações verificadas para este exame em um só lugar e economize horas de preparação. Mais de 1.000 certificações · Mais de 20 idiomas · Grátis para começar.
Passe no seu exame mais rápido → Não é necessário cartão