ある企業が、SageMakerエンドポイントに本番推論用のモデルをデプロイしようとしています。一般的なリクエストペイロードは100MBから300MBで、各リクエストは60分以内に完了する必要があります。どのSageMaker推論オプションを使用すべきですか?
解答を選択
オプションをタップして解答を確認してください。
正解: 非同期推論.
これが解答である理由
非同期推論は、ペイロードサイズが大きく(最大1GB)、処理時間が長い(最大1時間)推論リクエストに最適です。リクエストはキューに入れられ、非同期で処理されるため、クライアントは結果を待つことなく他のタスクに進めます。 サーバーレス推論は、コールドスタートのレイテンシーが許容される、散発的なトラフィックパターンに適していますが、ペイロードサイズと処理時間の制限がより厳しく、このユースケースには不向きです。リアルタイム推論は低レイテンシーが求められる場合に適していますが、ペイロードサイズと処理時間の制限が最も厳しいため、この要件には合いません。バッチ変換は、大量のデータを一度に処理する場合に利用され、リアルタイムまたはニアリアルタイムの応答が必要なエンドポイント推論には適していません。
試験に合格 — 終わりのない解答探しなしで
この試験のすべての検証済み問題と解説を1か所で入手し、準備時間を大幅に節約しましょう。1,000以上の認定 · 20以上の言語 · 無料で開始。
試験に早く合格する → カード不要