Firma chce wnioskować na urządzeniach brzegowych z absolutnie najniższym możliwym opóźnieniem, używając modeli językowych. Które podejście do wdrożenia najlepiej to osiągnie?
Wybierz odpowiedź
Dotknij opcji, aby sprawdzić swoją odpowiedź.
Poprawna odpowiedź: Wdrożenie zoptymalizowanych małych modeli językowych (SLM) bezpośrednio na urządzeniach brzegowych.
Dlaczego to jest odpowiedź
Wdrożenie zoptymalizowanych małych modeli językowych (SLM) bezpośrednio na urządzeniach brzegowych jest najlepszym rozwiązaniem dla absolutnie najniższego możliwego opóźnienia. Przetwarzanie odbywa się lokalnie, eliminując opóźnienia sieciowe związane z komunikacją z centralnym API. SLM-y są z natury mniejsze i mniej złożone niż LLM-y, co pozwala na ich efektywne uruchamianie na zasobach urządzeń brzegowych. Wdrożenie zoptymalizowanych dużych modeli językowych (LLM) bezpośrednio na urządzeniach brzegowych jest mniej optymalne, ponieważ LLM-y wymagają znacznie większych zasobów obliczeniowych i pamięci, co często przekracza możliwości urządzeń brzegowych i prowadzi do wyższego opóźnienia. Użycie scentralizowanego API (zarówno dla SLM, jak i LLM) wprowadza nieodłączne opóźnienia sieciowe, niezależnie od tego, czy wywołania są synchroniczne czy asynchroniczne. Asynchroniczne wywołania mogą poprawić przepustowość, ale nie zmniejszają indywidualnego opóźnienia pojedynczego wnioskowania.
Zdaj egzamin — bez niekończącego się szukania odpowiedzi
Uzyskaj wszystkie zweryfikowane pytania i wyjaśnienia do tego egzaminu w jednym miejscu i zaoszczędź godziny przygotowań. Ponad 1000 certyfikacji · Ponad 20 języków · Zacznij za darmo.
Zdaj egzamin szybciej → Karta nie jest wymagana