IoT 디바이스 플릿이 영구 Amazon EMR 클러스터의 HDFS에 ORC 파일로 데이터를 기록합니다. 분석가는 동일한 EMR 클러스터에서 Apache Presto를 사용하여 SQL 쿼리를 실행합니다. 쿼리는 항상 15분 이내에 완료되며 오후 5시부터 오후 10시 사이에만 실행됩니다. 회사는 SQL 쿼리를 계속 허용하면서도 더 비용 효율적인 솔루션을 원합니다. 가장 비용 효율적이고 요구 사항을 충족하는 솔루션은 무엇입니까?
정답 선택
옵션을 탭하여 정답을 확인하세요.
정답: 데이터를 Amazon S3에 저장하고 AWS Glue Data Catalog를 사용하며 Amazon Athena로 쿼리합니다..
이것이 정답인 이유
정답은 Amazon S3에 데이터를 저장하고 AWS Glue Data Catalog를 사용하며 Amazon Athena로 쿼리하는 것입니다. 이 솔루션은 서버리스 아키텍처를 활용하여 쿼리 실행 시에만 비용을 지불하므로 가장 비용 효율적입니다. Athena는 Presto를 기반으로 하며 S3에 저장된 데이터에 대해 SQL 쿼리를 실행할 수 있습니다. AWS Glue Data Catalog는 데이터 스키마를 관리하여 Athena가 데이터를 올바르게 해석하도록 돕습니다. 다른 옵션들은 다음과 같은 이유로 적합하지 않습니다. Amazon Redshift Spectrum을 사용하는 것은 가능하지만, Redshift 클러스터가 필요하므로 Athena보다 비용 효율적이지 않을 수 있습니다. EMR 클러스터를 계속 사용하는 것은 영구 클러스터 비용이 발생하므로 비용 효율성 목표에 부합하지 않습니다. 데이터를 Amazon Redshift에 로드하는 것은 데이터 로딩 및 클러스터 관리 비용이 발생하며, 쿼리가 간헐적으로 실행되는 시나리오에는 과도한 솔루션입니다.
끝없는 정답 찾기 없이 시험 합격
이 시험에 대한 모든 검증된 문제와 설명을 한곳에서 얻고, 준비 시간을 몇 시간 절약하세요. 1,000개 이상의 자격증 · 20개 이상의 언어 · 무료로 시작.
더 빠르게 시험 합격 → 카드 필요 없음