Praktyk AI tworzy aplikację wyszukiwania, która musi obsługiwać zapytania zawierające zarówno tekst, jak i obrazy. Jaki typ modelu podstawowego najlepiej nadaje się do obsługi tego multimodalnego wyszukiwania?
Wybierz odpowiedź
Dotknij opcji, aby sprawdzić swoją odpowiedź.
Poprawna odpowiedź: Multimodalny model osadzania (embedding).
Dlaczego to jest odpowiedź
Multimodalny model osadzania (embedding) jest najlepszy, ponieważ może przekształcać zarówno tekst, jak i obrazy w wektory (osadzenia) w tej samej przestrzeni semantycznej. Dzięki temu system wyszukiwania może porównywać zapytania tekstowe z obrazami i zapytania obrazowe z tekstem, znajdując najbardziej trafne dopasowania niezależnie od oryginalnego formatu danych. Tekstowy model osadzania obsługuje tylko tekst. Multimodalny model generatywny i model generowania obrazów są przeznaczone do tworzenia nowych treści, a nie do efektywnego wyszukiwania i porównywania istniejących danych multimodalnych.
Zdaj egzamin — bez niekończącego się szukania odpowiedzi
Uzyskaj wszystkie zweryfikowane pytania i wyjaśnienia do tego egzaminu w jednym miejscu i zaoszczędź godziny przygotowań. Ponad 1000 certyfikacji · Ponad 20 języków · Zacznij za darmo.
Zdaj egzamin szybciej → Karta nie jest wymagana