ある企業が最近AWSクラウドに移行し、Amazon S3に保存されている半構造化データセット(ログ、メディアファイル、トランザクション、IoT)の大規模なオンデマンド並列処理のためのサーバーレスソリューションを求めています。このソリューションは、数千の項目を並列処理できる必要があります。最も運用効率が高いオプションはどれですか?
解答を選択
オプションをタップして解答を確認してください。
正解: AWS Step FunctionsのMapステートを分散モードで使用して、データを並列処理します。.
これが解答である理由
正解は「AWS Step FunctionsのMapステートを分散モードで使用して、データを並列処理します」です。分散モードのMapステートは、数百万の並列ワークフロー実行を調整でき、大規模な半構造化データセットのオンデマンド並列処理に最適です。運用上のオーバーヘッドが少なく、スケーラビリティに優れています。 「AWS Step FunctionsのMapステートをインラインモードで使用して、データを並列処理します」は、最大25,000項目に制限されるため、大規模なデータセットには不向きです。 「AWS Glueを使用して、データを並列処理します」は、ETLジョブに適していますが、サーバーレスのオンデマンド並列処理ソリューションとしては、Step Functionsの分散Mapステートの方が運用効率が高い場合があります。 「複数のAWS Lambda関数を使用して、データを並列処理します」は、Lambdaの同時実行制限や調整の複雑さから、数千の項目を効率的に並列処理するには運用上の負担が大きくなります。
試験に合格 — 終わりのない解答探しなしで
この試験のすべての検証済み問題と解説を1か所で入手し、準備時間を大幅に節約しましょう。1,000以上の認定 · 20以上の言語 · 無料で開始。
試験に早く合格する → カード不要