MediLex obsługuje endpoint SageMaker w czasie rzeczywistym (instancje ml.m5.large) dla API wnioskowania NLP. Metryki CloudWatch zgłosiły średnio 800 wywołań na minutę w ciągu ostatniego szczytowego 5-minutowego interwału, a metryka InvocationsPerInstance wynosi 100 wywołań/minutę. Endpoint działa obecnie na 8 instancjach. Zespół SRE chce dopasować rozmiar, aby sprostać temu samemu szczytowemu ruchowi, zachowując to samo obciążenie na instancję (cel 150 wywołań na instancję). Korzystając z danych CloudWatch InvocationsPerInstance lub zagregowanych danych wywołań, ile instancji powinni udostępnić, aby osiągnąć cel 150 wywołań/instancję?
Wybierz odpowiedź
Dotknij opcji, aby sprawdzić swoją odpowiedź.
Poprawna odpowiedź: 6 instances.
Dlaczego to jest odpowiedź
Obecnie endpoint obsługuje 800 wywołań/minutę na 8 instancjach, co daje 100 wywołań/minutę na instancję (800 / 8 = 100). Zespół SRE chce osiągnąć cel 150 wywołań/minutę na instancję, utrzymując ten sam szczytowy ruch 800 wywołań/minutę. Aby obliczyć wymaganą liczbę instancji, dzielimy całkowitą liczbę wywołań przez docelową liczbę wywołań na instancję: 800 wywołań/minutę / 150 wywołań/minutę na instancję = 5.33 instancji. Ponieważ nie można mieć ułamkowej liczby instancji, należy zaokrąglić w górę do najbliższej liczby całkowitej, aby zapewnić obsługę całego ruchu, czyli 6 instancji.
Zdaj egzamin — bez niekończącego się szukania odpowiedzi
Uzyskaj wszystkie zweryfikowane pytania i wyjaśnienia do tego egzaminu w jednym miejscu i zaoszczędź godziny przygotowań. Ponad 1000 certyfikacji · Ponad 20 języków · Zacznij za darmo.
Zdaj egzamin szybciej → Karta nie jest wymagana