正确答案: 从Amazon Kinesis Data Streams收集数据。使用Amazon Kinesis Data Firehose将数据传输到Amazon S3数据湖。将数据加载到Amazon Redshift中进行分析。.
为什么这是答案
正确答案利用了AWS的流数据处理能力。Amazon Kinesis Data Streams可以实时收集大量点击流数据。Kinesis Data Firehose则能将这些流数据高效地传输到Amazon S3数据湖进行持久存储。最后,Amazon Redshift是一个完全托管的PB级数据仓库,非常适合对存储在S3中的大量点击流数据进行复杂的分析。
其他选项不适合或效率较低:
AWS Data Pipeline主要用于定期、批量的数据移动和转换,不适合实时或近实时的点击流数据摄取。
使用EC2实例的Auto Scaling组处理数据虽然可行,但需要更多的管理和配置,不如Kinesis服务那样专门为流数据优化。
将数据缓存到CloudFront是用于内容分发,而不是数据摄取和分析。Lambda函数处理S3对象添加事件适合事件驱动的少量数据处理,但对于每天30TB的点击流数据量可能效率不足且成本较高。