AmazonAmazon Machine Learning Specialty MLS-C01
·JA
·更新日 26 Jul 2026
データサイエンティストがSageMaker k-meansを使用して顧客をセグメント化し、最適なクラスター数 (k) を選択する必要があります。最適なkを最も確実に特定できる視覚化アプローチはどれですか?
解答を選択
オプションをタップして解答を確認してください。
正解: kの範囲でk-meansを実行し、各kの二乗誤差の合計 (SSE) を計算し、SSEとkをプロットします。曲線が線形に減少し始めるエルボーポイントのkを選択します。.
これが解答である理由
正解は、kの範囲でk-meansを実行し、各kの二乗誤差の合計 (SSE) を計算し、SSEとkをプロットし、曲線が線形に減少し始めるエルボーポイントのkを選択することです。これはエルボー法として知られ、最適なクラスター数を決定するための一般的なヒューリスティックです。SSEはクラスター内の凝集度を測定し、kが増加するにつれてSSEは減少しますが、ある点を超えると減少率は大幅に低下します。この「エルボー」が最適なkを示唆します。
他の選択肢は、最適なkを特定するのに効果的ではありません。
PCAコンポーネントに基づく散布図は、高次元データの場合、視覚的な分離が困難な場合があります。
PCAコンポーネントと説明された分散のプロットは、次元削減に役立ちますが、最適なクラスター数を直接示すものではありません。
t-SNEは視覚化ツールであり、パープレキシティ値はプロットの局所的および大域的構造のバランスに影響しますが、最適なkを決定するための直接的な指標ではありません。
試験に合格 — 終わりのない解答探しなしで
この試験のすべての検証済み問題と解説を1か所で入手し、準備時間を大幅に節約しましょう。1,000以上の認定 · 20以上の言語 · 無料で開始。
試験に早く合格する →
カード不要