AmazonAmazon Data Engineer Associate DEA-C01 Certification
·JA
·更新日 2 Aug 2026
ある会社は、顧客データを含む毎日約2GBの.xlsファイルをS3で受け取っています。データエンジニアは、名と姓の列を連結し、ファイル内の重複しない顧客の数をカウントする必要があります。運用上の労力が最も少ないアプローチはどれですか?
解答を選択
オプションをタップして解答を確認してください。
正解: AWS Glue DataBrewを使用して、COUNT_DISTINCT集計関数を使用して重複しない顧客の数を計算するレシピを作成します。.
これが解答である理由
AWS Glue DataBrewは、コードを書かずにデータのクレンジングと正規化を行うための視覚的なデータ準備ツールです。COUNTDISTINCT集計関数を含むレシピを作成することで、名と姓を連結し、重複しない顧客の数を簡単に計算できます。これは、運用上の労力を最小限に抑える最も効率的なアプローチです。AWS GlueノートブックとAmazon EMR Serverlessは、コードベースのソリューションであり、開発とメンテナンスに多くの労力が必要です。AWS GlueクローラーとAmazon AthenaはSQLクエリを使用しますが、DataBrewのような視覚的なインターフェースがないため、データ準備のステップが複雑になる可能性があります。
試験に合格 — 終わりのない解答探しなしで
この試験のすべての検証済み問題と解説を1か所で入手し、準備時間を大幅に節約しましょう。1,000以上の認定 · 20以上の言語 · 無料で開始。
試験に早く合格する →
カード不要