AmazonAmazon Data Engineer Associate DEA-C01 Certification
·JA
·更新日 2 Aug 2026
データエンジニアが、S3 バケット内の Apache Parquet オブジェクトを一度だけ読み込み、単一の列のみを抽出する必要があります。運用上のオーバーヘッドを最小限に抑えてこれを実現するオプションはどれですか?
解答を選択
オプションをタップして解答を確認してください。
正解: S3 Select を使用して SQL SELECT ステートメントを記述し、S3 オブジェクトから必要な列を取得します。.
これが解答である理由
S3 Selectは、S3バケット内のオブジェクトに対してSQLクエリを実行し、必要なデータのみを抽出できるため、運用上のオーバーヘッドを最小限に抑えられます。これにより、オブジェクト全体をダウンロードして処理する必要がなくなり、データ転送量と処理時間が削減されます。
AWS Lambda関数でpandasを使用する方法は、データフレームにロードするためにオブジェクト全体をダウンロードする必要があり、オーバーヘッドが増大します。AWS Glue DataBrewはデータ準備ツールであり、単一の列を一度だけ抽出する目的には過剰な機能です。AWS GlueクローラーとAmazon Athenaは、通常、永続的なデータカタログと反復的なクエリに使用され、一度限りの単一列抽出には設定と実行のオーバーヘッドが大きすぎます。
試験に合格 — 終わりのない解答探しなしで
この試験のすべての検証済み問題と解説を1か所で入手し、準備時間を大幅に節約しましょう。1,000以上の認定 · 20以上の言語 · 無料で開始。
試験に早く合格する →
カード不要