데이터 엔지니어는 Amazon EMR 및 Amazon Athena 쿼리에서 액세스할 수 있는 중앙 메타데이터 리포지토리를 유지 관리해야 하며, 기존 Apache Hive 메타데이터를 최소한의 개발 노력으로 가져와야 합니다. 어떤 솔루션을 사용해야 할까요?
정답 선택
옵션을 탭하여 정답을 확인하세요.
정답: AWS Glue Data Catalog를 사용합니다..
이것이 정답인 이유
AWS Glue Data Catalog는 Amazon EMR 및 Amazon Athena 쿼리에서 액세스할 수 있는 중앙 집중식 메타데이터 리포지토리 역할을 합니다. 기존 Apache Hive 메타데이터를 쉽게 가져올 수 있으며, 서버리스 서비스이므로 관리 오버헤드가 적습니다. 오답 해설: Amazon EMR 및 Apache Ranger: Ranger는 보안 및 권한 관리에 사용되지만, 중앙 메타데이터 리포지토리 역할은 하지 않습니다. EMR 클러스터에서 Hive metastore: EMR 클러스터에 종속되어 클러스터가 종료되면 메타데이터를 잃을 수 있으며, Athena와 직접 통합되지 않습니다. Amazon RDS for MySQL DB 인스턴스에서 metastore: RDS를 사용하여 Hive metastore를 호스팅할 수 있지만, AWS Glue Data Catalog는 서버리스이며 EMR 및 Athena와의 통합이 더 간편하고 효율적입니다.
끝없는 정답 찾기 없이 시험 합격
이 시험에 대한 모든 검증된 문제와 설명을 한곳에서 얻고, 준비 시간을 몇 시간 절약하세요. 1,000개 이상의 자격증 · 20개 이상의 언어 · 무료로 시작.
더 빠르게 시험 합격 → 카드 필요 없음