遺伝的アルゴリズムに基づくデプロイされたモデルは、予測を生成するのに数分かかる場合があり、最大100 MBのデータを含むリクエストを処理する必要があります。これらの要件を満たしながら運用上のオーバーヘッドを最小限に抑えるデプロイオプションはどれですか?
解答を選択
オプションをタップして解答を確認してください。
正解: Amazon SageMaker Asynchronous Inference エンドポイントにモデルをデプロイします。.
これが解答である理由
Amazon SageMaker Asynchronous Inference エンドポイントは、数分かかる推論時間と最大100MBのデータという要件に最適です。非同期処理により、クライアントはリクエストを送信した後すぐに応答を受け取ることができ、推論が完了したときに結果を取得できます。これにより、クライアントのタイムアウトを防ぎ、大規模なペイロードを効率的に処理できます。運用オーバーヘッドも、SageMakerがインフラストラクチャを管理するため最小限に抑えられます。 Amazon EC2インスタンスへのデプロイは、Auto ScalingグループやECSを使用しても、インフラストラクチャの管理や非同期処理のロジックを自身で実装する必要があり、運用オーバーヘッドが増大します。Amazon SageMakerリアルタイムエンドポイントは、低レイテンシーの推論に適していますが、推論に数分かかる場合はクライアントのタイムアウトを引き起こす可能性があり、大規模なペイロードの処理にも制限があります。
試験に合格 — 終わりのない解答探しなしで
この試験のすべての検証済み問題と解説を1か所で入手し、準備時間を大幅に節約しましょう。1,000以上の認定 · 20以上の言語 · 無料で開始。
試験に早く合格する → カード不要