Firma zamierza używać generatywnego modelu AI do dostarczania użytkownikom wycen usług w czasie rzeczywistym. Które kryterium wyboru jest najważniejsze dla tej aplikacji?
Wybierz odpowiedź
Dotknij opcji, aby sprawdzić swoją odpowiedź.
Poprawna odpowiedź: Niskie opóźnienia i wydajność wnioskowania zoptymalizowana pod kątem szybkich odpowiedzi.
Dlaczego to jest odpowiedź
Dla aplikacji dostarczającej wyceny usług w czasie rzeczywistie kluczowe jest, aby system reagował natychmiast. Niskie opóźnienia (latency) zapewniają szybką odpowiedź na zapytanie użytkownika, a zoptymalizowana wydajność wnioskowania (inference performance) gwarantuje, że model przetworzy dane i wygeneruje wycenę bez zbędnych opóźnień. Użytkownicy oczekują natychmiastowej interakcji, a każde opóźnienie może negatywnie wpłynąć na ich doświadczenie. Całkowity rozmiar modelu jest mniej istotny niż jego szybkość działania, choć może wpływać na koszty i złożoność wdrożenia. Jakość danych treningowych jest fundamentalna dla dokładności modelu, ale nawet idealnie wytrenowany model będzie bezużyteczny, jeśli nie będzie w stanie szybko dostarczyć odpowiedzi. Wybór modelu ogólnego przeznaczenia i dostęp do GPU są ważne dla rozwoju i trenowania, ale nie są najważniejszym kryterium dla produkcyjnej wydajności w czasie rzeczywistym.
Zdaj egzamin — bez niekończącego się szukania odpowiedzi
Uzyskaj wszystkie zweryfikowane pytania i wyjaśnienia do tego egzaminu w jednym miejscu i zaoszczędź godziny przygotowań. Ponad 1000 certyfikacji · Ponad 20 języków · Zacznij za darmo.
Zdaj egzamin szybciej → Karta nie jest wymagana