데이터 볼륨 증가 후 Hadoop의 배치 MapReduce 분석이 지연되고 있습니다. 비용을 늘리지 않고 응답성을 개선하려면 어떻게 해야 할까요?
정답 선택
옵션을 탭하여 정답을 확인하세요.
정답: 작업을 Apache Spark로 다시 작성합니다..
이것이 정답인 이유
데이터 볼륨 증가로 인해 Hadoop MapReduce 분석이 지연될 때, 비용 증가 없이 응답성을 개선하는 가장 효과적인 방법은 작업을 Apache Spark로 다시 작성하는 것입니다. Spark는 인메모리 처리, DAG(Directed Acyclic Graph) 실행 엔진, 최적화된 데이터 처리 방식을 통해 MapReduce보다 훨씬 빠른 성능을 제공합니다. Pig로 다시 작성하는 것은 MapReduce의 추상화 계층일 뿐 근본적인 성능 개선을 가져오지 않습니다. Hadoop 클러스터의 크기를 늘리는 것은 비용을 증가시키므로 문제의 조건에 부합하지 않습니다. 클러스터 크기를 줄이고 Hive로 다시 작성하는 것은 성능을 더욱 저하시킬 수 있습니다.
끝없는 정답 찾기 없이 시험 합격
이 시험에 대한 모든 검증된 문제와 설명을 한곳에서 얻고, 준비 시간을 몇 시간 절약하세요. 1,000개 이상의 자격증 · 20개 이상의 언어 · 무료로 시작.
더 빠르게 시험 합격 → 카드 필요 없음