Un profesional de IA está creando una aplicación de búsqueda que necesita manejar consultas que contengan tanto texto como imágenes. ¿Qué tipo de modelo fundacional es el más adecuado para impulsar esta búsqueda multimodal?
Elige una respuesta
Toca una opción para verificar tu respuesta.
Respuesta correcta: Modelo de incrustación multimodal.
Por qué esta es la respuesta
Un modelo de incrustación multimodal es el más adecuado porque puede procesar y representar datos de múltiples modalidades (texto e imágenes) en un espacio vectorial común. Esto permite comparar y recuperar consultas que combinan texto e imágenes de manera efectiva. Un modelo de incrustación de texto solo manejaría el texto, ignorando las imágenes. Un modelo de generación multimodal crea contenido nuevo a partir de múltiples entradas, no es para búsqueda. Un modelo de generación de imágenes crea imágenes, lo cual no es el objetivo de una aplicación de búsqueda multimodal.
Aprueba tu examen — sin la interminable búsqueda de respuestas
Obtén todas las preguntas y explicaciones verificadas para este examen en un solo lugar, y ahorra horas de preparación. Más de 1,000 certificaciones · Más de 20 idiomas · Empieza gratis.
Aprueba tu examen más rápido → No se requiere tarjeta