MediLex gebruikt een SageMaker real-time endpoint (ml.m5.large instances) voor een NLP inference API. CloudWatch metrics rapporteerden een gemiddelde van 800 invocations per minuut over het laatste piekinterval van 5 minuten en de metric InvocationsPerInstance is 100 invocations/minuut. Het endpoint draait momenteel op 8 instances. Het SRE-team wil de grootte aanpassen om hetzelfde piekverkeer te kunnen verwerken, terwijl dezelfde belasting per instance behouden blijft (doel 150 invocations per instance). Hoeveel instances moeten ze, gebruikmakend van de CloudWatch InvocationsPerInstance of geaggregeerde invocation data, provisionen om het doel van 150 invocations/instance te bereiken?
Kies een antwoord
Tik op een optie om je antwoord te controleren.
Correct antwoord: 6 instances.
Waarom dit het antwoord is
De huidige belasting per instance is 800 invocations/minuut / 8 instances = 100 invocations/minuut per instance. Het doel is om 150 invocations/minuut per instance te bereiken. Om dit doel te bereiken met een totaal van 800 invocations/minuut, is het benodigde aantal instances 800 invocations/minuut / 150 invocations/minuut per instance = 5,33 instances. Aangezien het aantal instances een geheel getal moet zijn, ronden we naar boven af om ervoor te zorgen dat de belasting per instance niet boven het doel uitkomt. Daarom zijn 6 instances nodig. De andere opties zouden leiden tot een hogere of lagere belasting per instance dan het gestelde doel.
Slaag voor je examen — zonder eindeloos zoeken naar antwoorden
Krijg elke geverifieerde vraag en uitleg voor dit examen op één plek, en bespaar uren voorbereiding. Meer dan 1.000 certificeringen · Meer dan 20 talen · gratis om te beginnen.
Slaag sneller voor je examen → Geen kaart nodig