【发布时间】:2023-04-01 19:26:01
【问题描述】:
根据this StackOverflow question,概率数据结构是给出近似而非精确答案的数据结构。特别是,它们具有非常低的时间和空间复杂性,并且易于并行化,这使得它们的使用非常有效。提供的示例包括 Bloom Filters、Count-Min Sketch 和 HyperLogLog。
但是,所有这些数据结构也被称为“草图”数据结构 - 通过紧凑表示来近似大集合的结构,以实现更高效(但不太精确)的操作。
我看不出“草图”和“概率”数据结构之间的区别。
【问题讨论】:
标签: data-structures approximation bloom-filter hyperloglog