MediLex는 NLP 추론 API를 위해 SageMaker 실시간 엔드포인트(ml.m5.large 인스턴스)를 운영합니다. CloudWatch 지표에 따르면 지난 피크 5분 간격 동안 분당 평균 800회의 호출이 보고되었으며, InvocationsPerInstance 지표는 분당 100회 호출입니다. 엔드포인트는 현재 8개의 인스턴스를 실행하고 있습니다. SRE 팀은 동일한 인스턴스당 로드(대상 인스턴스당 150회 호출)를 유지하면서 동일한 피크 트래픽을 충족하도록 적정 규모를 조정하려고 합니다. CloudWatch InvocationsPerInstance 또는 집계 호출 데이터를 사용하여 인스턴스당 150회 호출 목표에 도달하려면 몇 개의 인스턴스를 프로비저닝해야 할까요?
정답 선택
옵션을 탭하여 정답을 확인하세요.
정답: 6 instances.
이것이 정답인 이유
현재 피크 트래픽은 분당 800회 호출입니다. 목표는 인스턴스당 분당 150회 호출입니다. 필요한 인스턴스 수를 계산하려면 총 호출 수를 목표 인스턴스당 호출 수로 나누면 됩니다. 800 호출/분 ÷ 150 호출/인스턴스 = 5.33 인스턴스. 인스턴스는 정수여야 하므로, 트래픽을 처리하기 위해 6개의 인스턴스가 필요합니다. 4개 인스턴스는 600 호출/분만 처리할 수 있고, 8개 인스턴스는 목표보다 낮은 인스턴스당 부하를 초래하며, 10개 인스턴스는 과도하게 프로비저닝됩니다.
끝없는 정답 찾기 없이 시험 합격
이 시험에 대한 모든 검증된 문제와 설명을 한곳에서 얻고, 준비 시간을 몇 시간 절약하세요. 1,000개 이상의 자격증 · 20개 이상의 언어 · 무료로 시작.
더 빠르게 시험 합격 → 카드 필요 없음