【发布时间】:2014-10-26 03:07:04
【问题描述】:
假设我需要统计一个非常大的文件中的单词(单词被 " " 分割)
我会关注
- 不在内存中加载整个文件,逐行读取流。
- 对于每一行拆分单词并将不同的单词添加到“字典”(我的意思是,使用字典类 在 .NET 中) 的数量。
现在要检索最常用的单词,对字典进行排序并获取它。
但大多数解决方案都支持 Trie 数据结构,请说明原因(另外,如果不说明字典上的哈希表的原因,那就太好了)。
谢谢。
【问题讨论】:
-
究竟是什么意思非常大?
-
“为什么不在字典上散列表”:
Dictionary<K,V>是散列表;它与Hashtable类基本相同,只是它是通用的。 -
你自己试试吧。当您查询“c# trie class”时,您会从 Google 获得大量帮助。当您将它与 Linq 查询或字典进行比较时,您会发现了解现代计算机的工作方式非常非常重要的东西。并且能够提出一个很好的问题。
标签: c# .net data-structures hashtable idictionary