MediLex は、NLP 推論 API 用の SageMaker リアルタイムエンドポイント (ml.m5.large インスタンス) を運用しています。CloudWatch メトリクスでは、過去のピーク時 5 分間の平均呼び出し数が 1 分あたり 800 回で、InvocationsPerInstance メトリクスは 1 インスタンスあたり 100 回/分と報告されています。エンドポイントは現在 8 つのインスタンスで実行されています。SRE チームは、同じピークトラフィックに対応し、インスタンスあたりの負荷を同じに保ちながら (ターゲットは 1 インスタンスあたり 150 回の呼び出し)、適切なサイズに調整したいと考えています。CloudWatch の InvocationsPerInstance または集計された呼び出しデータを使用して、1 インスタンスあたり 150 回の呼び出しというターゲットに到達するために、いくつのインスタンスをプロビジョニングする必要がありますか?
解答を選択
オプションをタップして解答を確認してください。
正解: 6 instances.
これが解答である理由
現在のピークトラフィックは1分あたり800回の呼び出しです。目標は、インスタンスあたりの呼び出し数を150回/分にすることです。必要なインスタンス数を計算するには、総呼び出し数を目標のインスタンスあたりの呼び出し数で割ります。800呼び出し/分 ÷ 150呼び出し/分/インスタンス = 5.33インスタンス。インスタンスは整数である必要があるため、トラフィックを処理し、目標を達成するために6つのインスタンスが必要です。4インスタンスでは負荷が高すぎ、8インスタンスまたは10インスタンスではインスタンスあたりの負荷が目標より低くなります。
試験に合格 — 終わりのない解答探しなしで
この試験のすべての検証済み問題と解説を1か所で入手し、準備時間を大幅に節約しましょう。1,000以上の認定 · 20以上の言語 · 無料で開始。
試験に早く合格する → カード不要