【发布时间】:2011-09-22 14:28:17
【问题描述】:
我正在尝试在 Mathematica 8 (12k+) 中搜索大量文本文件。到目前为止,我已经能够绘制出一个单词出现的绝对次数(即“爱”这个词在这 12k 个文件中出现了 5000 次)。但是,我很难确定“love”出现一次的文件数量——可能只有 1,000 个文件,而在其他文件中会重复多次。
我发现文档 WRT FindList、流、RecordSeparators 等有点模糊。有没有办法设置它,让它在文件中找到一个术语的出现一次,然后移动到下一个?
文件列表示例:
{“89001.txt”、“89002.txt”、“89003.txt”、“89004.txt”、“89005.txt”、“89006.txt”、“89007.txt”、“89008.txt” "、"89009.txt"、"89010.txt"、"89011.txt"、"89012.txt"、"89013.txt"、"89014.txt"、"89015.txt"、"89016.txt"、 “89017.txt”、“89018.txt”、“89019.txt”、“89020.txt”、“89021.txt”、“89022.txt”、“89023.txt”、“89024.txt”}
以下内容返回每个文件中带有爱的所有行。有没有办法只返回每个文件中的第一次爱,然后再转到下一个?
FindList[filelist, "love"]
非常感谢。这是我的第一篇文章,我主要通过同行/主管帮助、在线教程和文档来学习 Mathematica。
【问题讨论】:
-
不要忘记为有帮助的答案投票(当您获得 15 名声望时),如果有人回答了您的问题,请将其标记为已接受。
-
感谢您的提醒,rcollyer(总是很高兴了解社区标准)。在我实施这些建议时,我可能需要一些时间来完全解决这个问题,但如果我有代表,我肯定会支持这些。
-
查看FAQ 以获得对标准的全面解释。
-
@ian 对您的用户 ID 稍作更改可能会很好:避免以“i”开头,因为大写会将其变为“I”,这无法与小写“L”区分开来,并且您会错过 cmets
-
@belisarius 很棒的电话,我已经更改了我的用户名。
标签: search text wolfram-mathematica