GoogleGoogle Professional Data Engineer (PDE) Certification·KO·업데이트됨 21 Aug 2026
업스트림 쓰기는 미국 내 어디에서든 Cloud Storage로 들어옵니다. Dataproc Spark 작업은 us-central1에서 실행됩니다. RPO가 15분 이하이고 읽기 지연 시간이 최소화된 단일 리전 장애에 대한 재해 복구가 필요합니다. 어떤 스토리지 아키텍처가 이를 충족할까요?
정답 선택
옵션을 탭하여 정답을 확인하세요.
정답: 1. us-central1과 us-south1에 걸쳐 있는 듀얼 리전 버킷을 생성합니다. 2. turbo replication을 활성화합니다. 3. Dataproc을 us-central1에서 실행하고 동일한 리전의 버킷에서 읽습니다. 4. 장애 발생 시 Dataproc을 us-south1에 재배포하고 동일한 버킷에서 읽습니다..
이것이 정답인 이유
정답은 듀얼 리전 버킷과 터보 복제를 사용하여 us-central1과 us-south1에 데이터를 저장하는 것입니다. 듀얼 리전 버킷은 두 리전 모두에서 읽기 지연 시간을 최소화하고, 터보 복제는 15분 미만의 RPO를 보장합니다. Dataproc은 us-central1에서 실행되어 해당 리전의 버킷에서 읽으므로 읽기 지연 시간을 더욱 줄입니다. us-central1에 장애가 발생하면 Dataproc을 us-south1에 재배포하여 동일한 듀얼 리전 버킷에서 계속 읽을 수 있으므로 단일 리전 장애에 대한 재해 복구 요구 사항을 충족합니다.
다른 옵션들은 다음 이유로 적합하지 않습니다.
두 개의 리전 버킷을 사용하고 Storage Transfer Service로 복사하는 것은 15분 미만의 RPO를 충족하기 어렵습니다.
미국 멀티 리전 버킷은 여러 리전에 데이터를 분산하지만, 특정 두 리전 간의 낮은 지연 시간 및 RPO 보장에는 듀얼 리전 버킷이 더 적합합니다. 또한, us-central2는 존재하지 않는 리전입니다.
듀얼 리전 버킷을 사용하지만 Dataproc이 us-south1의 버킷에서 읽도록 하는 것은 us-central1에서 실행되는 Dataproc의 읽기 지연 시간을 증가시킵니다.