Um profissional de IA está desenvolvendo um aplicativo de busca que precisa lidar com consultas contendo texto e imagens. Qual tipo de modelo de base é o mais adequado para alimentar essa busca multimodal?
Escolha uma resposta
Toque em uma opção para verificar sua resposta.
Resposta correta: Multi-modal embedding model.
Por que esta é a resposta
Um modelo de embedding multimodal é o mais adequado porque ele pode processar e representar dados de diferentes modalidades (texto e imagem) em um espaço vetorial comum. Isso permite que o sistema de busca compare e recupere itens relevantes, independentemente de a consulta ser textual, visual ou uma combinação de ambos. Um modelo de embedding de texto só processaria texto, ignorando as imagens. Um modelo de geração multimodal ou de geração de imagem são projetados para criar novos dados (texto ou imagem), não para criar representações para busca e comparação.
Passe no seu exame — sem a busca interminável por respostas
Obtenha todas as perguntas e explicações verificadas para este exame em um só lugar e economize horas de preparação. Mais de 1.000 certificações · Mais de 20 idiomas · Grátis para começar.
Passe no seu exame mais rápido → Não é necessário cartão