한 전자상거래 회사가 개인 식별 정보(PII)를 포함하여 테라바이트 규모의 고객 데이터를 AWS에 저장합니다. 세 가지 애플리케이션이 이 데이터를 사용하며, 그중 한 애플리케이션만 PII를 필요로 합니다. 다른 두 애플리케이션이 데이터를 처리하기 전에 PII를 제거해야 합니다. 운영 오버헤드를 최소화하면서 이러한 요구 사항을 충족하는 솔루션은 무엇입니까?
정답 선택
옵션을 탭하여 정답을 확인하세요.
정답: 데이터를 Amazon S3 버킷에 저장합니다. 요청하는 애플리케이션에 데이터를 반환하기 전에 S3 Object Lambda를 사용하여 데이터를 처리하고 변환합니다..
이것이 정답인 이유
정답은 S3 Object Lambda를 사용하여 데이터를 처리하고 변환하는 것입니다. S3 Object Lambda는 S3에서 객체를 검색할 때 사용자 지정 코드를 사용하여 데이터를 변환할 수 있게 해줍니다. 이 접근 방식은 PII가 필요 없는 두 애플리케이션에 데이터를 반환하기 전에 PII를 제거하여 데이터 중복을 피하고 운영 오버헤드를 최소화합니다.
DynamoDB는 대규모 비정형 데이터 저장에는 적합하지만, 테라바이트 규모의 고객 데이터와 PII 제거와 같은 복잡한 변환에는 S3가 더 비용 효율적이고 유연합니다. 프록시 애플리케이션 계층을 생성하는 것은 추가적인 관리 오버헤드를 발생시킵니다. 데이터를 세 개의 개별 S3 버킷이나 DynamoDB 테이블에 저장하는 것은 데이터 중복을 초래하고 저장 및 관리 비용을 증가시킵니다.