将 10 TB 的初始数据加载到 Bigtable 中以用于 ML 特征,但读/写性能不佳。您希望在最小化成本的同时提高吞吐量。您应该怎么做?
选择一个答案
点击一个选项来检查您的答案。
正确答案: 重新定义 schema,使读写操作均匀分布在表的行键空间中。.
为什么这是答案
重新定义 schema,使读写操作均匀分布在表的行键空间中是正确的做法。Bigtable 的性能高度依赖于行键的设计。一个好的行键设计能够将读写操作均匀地分散到集群中的不同节点上,从而避免热点并提高吞吐量。通过重新设计 schema,确保行键能够实现均匀分布,可以显著提升性能,同时避免不必要的成本增加。 通过随着时间增加 Bigtable 集群的大小来解决性能问题是次优的,因为如果行键设计不当,即使增加集群大小也可能无法解决热点问题,导致资源浪费。重新设计 schema,对频繁更新的值使用单个热点行键是错误的,这会造成严重的性能瓶颈,因为所有操作都集中在一个节点上。对插入操作使用按用户递增的顺序数字行键(顺序 ID)也是错误的,这种设计会导致所有新写入都集中在集群的末端,形成热点,降低写入吞吐量。
通过考试 — 无需无休止地寻找答案
将本次考试的所有验证问题和解释集中在一处,节省数小时的准备时间。1,000+ 认证 · 20+ 语言 · 免费开始。
更快通过考试 → 无需银行卡