データサイエンティストが、まれな異常を発見するための探索的データ分析のために、Amazon SageMaker Data Wrangler を使用して履歴 S3 データをインジェストします。EDA の実行中にコンピューティングリソースを最小限に抑えるには、データサイエンティストはどのインポートオプションを選択すべきですか?
解答を選択
オプションをタップして解答を確認してください。
正解: ドメイン知識に基づいて K を選択し、First K オプションを使用してデータをインポートする。.
これが解答である理由
まれな異常の探索的データ分析(EDA)では、異常がデータセットの先頭に現れる可能性は低いですが、データセット全体に散在している可能性があります。コンピューティングリソースを最小限に抑えつつ、異常を見つける可能性を最大化するには、データセットの最初のK行をインポートする「First K」オプションが最も効率的です。これにより、データサイエンティストはドメイン知識に基づいて適切なKを選択し、データ全体を処理することなく、異常の兆候を迅速に確認できます。「None」は全データをインポートするためリソースを消費し、「Stratified」や「Randomized」はランダムサンプリングを行うため、まれな異常を見逃すリスクが高まります。
試験に合格 — 終わりのない解答探しなしで
この試験のすべての検証済み問題と解説を1か所で入手し、準備時間を大幅に節約しましょう。1,000以上の認定 · 20以上の言語 · 無料で開始。
試験に早く合格する → カード不要