BrightDrive chce zastąpić mało obciążony punkt końcowy GPU czasu rzeczywistego usługą SageMaker Serverless Inference w celu obniżenia kosztów. Muszą kontrolować współbieżność i rozumieć kompromisy związane z opóźnieniami. Które stwierdzenie najdokładniej opisuje, jak skonfigurować usługę bezserwerową i jakie są kompromisy w porównaniu z trwałym punktem końcowym czasu rzeczywistego?
Wybierz odpowiedź
Dotknij opcji, aby sprawdzić swoją odpowiedź.
Poprawna odpowiedź: Skonfiguruj konfigurację Serverless Inference z MaxConcurrency (np. 10) i odpowiednim rozmiarem pamięci; usługa bezserwerowa będzie skalować się od zera, co może powodować opóźnienia zimnego startu przy pierwszych żądaniach. Usługa bezserwerowa jest opłacalna dla sporadycznego ruchu, ale trwały punkt końcowy czasu rzeczywistego zapewnia niższe, bardziej spójne opóźnienia i obsługuje GPU oraz udostępnioną pojemność..
Dlaczego to jest odpowiedź
Poprawna odpowiedź opisuje kluczowe aspekty SageMaker Serverless Inference. Można skonfigurować MaxConcurrency i rozmiar pamięci, aby kontrolować zasoby. Usługa bezserwerowa skaluje się do zera, co jest opłacalne dla sporadycznego ruchu, ale wiąże się z opóźnieniami zimnego startu dla pierwszych żądań. Trwałe punkty końcowe w czasie rzeczywistym oferują niższe, bardziej spójne opóźnienia i obsługują GPU, co jest kluczowe dla obciążeń wymagających wysokiej wydajności. Niepoprawne opcje: Ustawienie ProvisionedConcurrency nie jest dostępne dla Serverless Inference. Serverless Inference nie obsługuje również typów instancji GPU. Serverless Inference ma ustawienia współbieżności (MaxConcurrency). Przejście na Serverless nie gwarantuje identycznych opóźnień p99, a zimne starty występują niezależnie od MaxConcurrency 1.
Zdaj egzamin — bez niekończącego się szukania odpowiedzi
Uzyskaj wszystkie zweryfikowane pytania i wyjaśnienia do tego egzaminu w jednym miejscu i zaoszczędź godziny przygotowań. Ponad 1000 certyfikacji · Ponad 20 języków · Zacznij za darmo.
Zdaj egzamin szybciej → Karta nie jest wymagana