Ein KI-Experte entwickelt eine Suchanwendung, die Abfragen mit Text und Bildern verarbeiten muss. Welcher Typ von Grundmodell eignet sich am besten, um diese multimodale Suche zu unterstützen?
Wählen Sie eine Antwort
Tippen Sie auf eine Option, um Ihre Antwort zu überprüfen.
Richtige Antwort: Multimodales Einbettungsmodell.
Warum dies die Antwort ist
Ein multimodales Einbettungsmodell ist die beste Wahl, da es sowohl Text- als auch Bilddaten in einen gemeinsamen Vektorraum (Einbettungen) transformieren kann. Dies ermöglicht den direkten Vergleich und die Suche über verschiedene Modalitäten hinweg, was für eine multimodale Suchanwendung unerlässlich ist. Ein Texteinbettungsmodell verarbeitet nur Text, während ein Bildgenerierungsmodell Bilder erzeugt und kein Vergleichsmodell ist. Ein multimodales Generierungsmodell würde neue Inhalte aus verschiedenen Modalitäten erstellen, aber nicht direkt für die Suche optimiert sein.
Bestehen Sie Ihre Prüfung – ohne endlose Antwortsuche
Erhalten Sie jede verifizierte Frage und Erklärung für diese Prüfung an einem Ort und sparen Sie Stunden der Vorbereitung. Über 1.000 Zertifizierungen · Über 20 Sprachen · Kostenloser Start.
Bestehen Sie Ihre Prüfung schneller → Keine Karte erforderlich