【发布时间】:2012-01-18 03:26:20
【问题描述】:
我在网上搜索并访问了中位数算法的 wiki 页面。但似乎找不到对我的问题的明确陈述:
如果一个人有一个非常大的整数列表(大小为 TB),并且希望以分布式方式找到该列表的中位数,那么会将列表分解为不同大小的子列表(或相等并不真的问题),然后继续计算那些较小子列表的中位数,然后计算这些中位数的中位数导致原始大列表的中位数?
此外,对于任何第 k 个统计数据,此陈述是否也正确?我会对这个领域的研究等链接感兴趣。
【问题讨论】:
-
为什么这个问题被否决了?
-
这个问题对于即将到来的Computer Science Stack Exchange 来说是完美的。所以,如果你想有一个地方来回答这样的问题,请继续帮助这个提案起飞!
标签: algorithm computer-science complexity-theory median-of-medians