Un praticien de l'IA développe une application de recherche qui doit gérer des requêtes contenant à la fois du texte et des images. Quel type de modèle de fondation est le mieux adapté pour alimenter cette recherche multimodale ?
Choisissez une réponse
Appuyez sur une option pour vérifier votre réponse.
Bonne réponse : Modèle d'intégration multimodal.
Pourquoi c'est la réponse
Un modèle d'intégration multimodal est le mieux adapté car il est conçu pour traiter et comprendre plusieurs types de données (comme le texte et les images) simultanément, en les transformant en une représentation vectorielle commune (intégration). Cela permet de comparer et de rechercher efficacement des requêtes qui contiennent à la fois du texte et des images, car le système peut trouver des correspondances sémantiques entre les différentes modalités. Un modèle d'intégration de texte ne traiterait que le texte, ignorant les images. Les modèles de génération multimodaux ou d'images sont conçus pour créer du contenu (texte, images ou les deux) plutôt que pour la recherche et la compréhension de requêtes existantes.
Réussissez votre examen — sans la chasse aux réponses interminable
Obtenez toutes les questions et explications vérifiées pour cet examen en un seul endroit, et économisez des heures de préparation. Plus de 1 000 certifications · Plus de 20 langues · Gratuit pour commencer.
Réussissez votre examen plus rapidement → Pas de carte requise