솔루션스 아키텍트는 Amazon S3 버킷에 대량의 세미정형 데이터를 저장하는 분석 애플리케이션을 관리합니다. 아키텍트는 처리 속도를 높이기 위해 병렬 데이터 처리를 원하고, Amazon Redshift 데이터베이스에 저장된 정보를 사용하여 데이터를 보강하려고 합니다. 이러한 요구 사항을 충족하는 솔루션은 무엇입요?
정답 선택
옵션을 탭하여 정답을 확인하세요.
정답: Amazon EMR을 사용하여 S3 데이터를 처리합니다. Amazon Redshift 데이터와 함께 Amazon EMR을 사용하여 S3 데이터를 보강합니다..
이것이 정답인 이유
대량의 세미정형 데이터 병렬 처리 및 Amazon Redshift 데이터와의 보강에는 Amazon EMR이 가장 적합합니다. EMR은 Apache Spark, Hive, Presto와 같은 빅데이터 프레임워크를 사용하여 S3의 데이터를 효율적으로 처리하고, Redshift와 직접 연동하여 데이터를 보강할 수 있습니다. 다른 옵션들은 다음과 같은 이유로 적합하지 않습니다. Amazon Athena는 대화형 쿼리에 적합하지만, 대량의 복잡한 데이터 처리 및 보강 작업에는 EMR만큼 유연하고 강력하지 않습니다. Amazon Kinesis Data Streams는 실시간 스트리밍 데이터 수집에 사용되며, S3 데이터 보강과는 직접적인 관련이 없습니다. AWS Glue는 ETL(추출, 변환, 로드) 서비스로 데이터 카탈로그 및 변환에 유용하지만, 대량의 병렬 처리 및 Redshift와의 복잡한 통합 보강 작업에는 EMR이 더 강력한 기능을 제공합니다. AWS Lake Formation은 데이터 레이크 보안 및 거버넌스에 중점을 둡니다.
끝없는 정답 찾기 없이 시험 합격
이 시험에 대한 모든 검증된 문제와 설명을 한곳에서 얻고, 준비 시간을 몇 시간 절약하세요. 1,000개 이상의 자격증 · 20개 이상의 언어 · 무료로 시작.
더 빠르게 시험 합격 → 카드 필요 없음