보고 시스템은 매일 수백 개의 .csv 파일을 Amazon S3 버킷으로 전송합니다. 회사는 이 파일들을 Apache Parquet으로 변환하고 그 결과를 변환된 데이터 버킷에 저장해야 합니다. 개발 노력을 최소화하면서 이 요구 사항을 충족하는 솔루션은 무엇입니까?
정답 선택
옵션을 탭하여 정답을 확인하세요.
정답: 데이터를 검색하기 위해 AWS Glue crawler를 생성하고 데이터를 변환하기 위해 AWS Glue extract, transform, and load (ETL) 작업을 생성하며, 변환된 데이터 버킷을 ETL 출력으로 지정합니다..
이것이 정답인 이유
정답은 AWS Glue입니다. AWS Glue는 서버리스 ETL(추출, 변환, 로드) 서비스로, 개발 노력을 최소화하면서 대량의 데이터를 변환하는 데 매우 적합합니다. Glue crawler는 S3 버킷의 .csv 파일을 자동으로 검색하여 스키마를 추론하고 AWS Glue Data Catalog에 메타데이터를 저장합니다. 이후 Glue ETL 작업을 생성하여 이 메타데이터를 기반으로 .csv 파일을 Apache Parquet 형식으로 변환하고, 그 결과를 지정된 S3 버킷에 저장할 수 있습니다. 다른 옵션들은 다음과 같은 이유로 적절하지 않습니다. Amazon EMR은 Spark 애플리케이션을 작성하고 클러스터를 관리해야 하므로 개발 및 운영 노력이 더 많이 필요합니다. AWS Batch는 Bash 스크립트를 실행할 수 있지만, 데이터 변환 로직을 직접 구현해야 하며 Glue만큼 관리형 서비스가 아닙니다. AWS Lambda는 단일 파일 변환에는 적합할 수 있지만, 매일 수백 개의 파일을 처리하기에는 Lambda 함수의 실행 시간 제한(15분) 및 메모리 제한으로 인해 복잡해질 수 있습니다. 또한, 대량의 파일에 대한 일괄 처리를 직접 구현해야 합니다.
끝없는 정답 찾기 없이 시험 합격
이 시험에 대한 모든 검증된 문제와 설명을 한곳에서 얻고, 준비 시간을 몇 시간 절약하세요. 1,000개 이상의 자격증 · 20개 이상의 언어 · 무료로 시작.
더 빠르게 시험 합격 → 카드 필요 없음