한 회사에 다양한 파일 형식(CSV, JSON, XLSX, Apache Parquet)이 혼합된 S3 폴더가 있습니다. ML 엔지니어는 AWS Glue DataBrew를 사용하여 데이터를 처리하고 최종 결과물을 S3에 다시 저장하여 AWS Glue가 나중에 사용할 수 있도록 해야 합니다. 다음 접근 방식 중 이러한 요구 사항을 충족하는 것은 무엇입니까?
정답 선택
옵션을 탭하여 정답을 확인하세요.
정답: 파일을 파일 형식별로 별도의 폴더로 분리하고, DataBrew로 각 폴더를 처리한 다음, 결과물을 Apache Parquet 형식으로 작성합니다..
이것이 정답인 이유
AWS Glue DataBrew는 단일 데이터 세트 내에서 여러 파일 형식을 직접 처리하는 것을 지원하지 않습니다. 따라서 CSV, JSON, XLSX, Apache Parquet 등 다양한 파일 형식이 혼합된 S3 폴더를 처리하려면 먼저 각 파일 형식을 별도의 폴더로 분리해야 합니다. 이렇게 분리된 각 폴더에 대해 DataBrew 작업을 생성하여 처리하고, 최종 결과물은 AWS Glue가 쉽게 사용할 수 있도록 Apache Parquet 형식으로 저장하는 것이 가장 효율적이고 권장되는 방법입니다. "AWS Glue Parquet 형식"은 존재하지 않으며, Apache Parquet이 표준 형식입니다.
끝없는 정답 찾기 없이 시험 합격
이 시험에 대한 모든 검증된 문제와 설명을 한곳에서 얻고, 준비 시간을 몇 시간 절약하세요. 1,000개 이상의 자격증 · 20개 이상의 언어 · 무료로 시작.
더 빠르게 시험 합격 → 카드 필요 없음