【发布时间】:2020-12-02 20:22:10
【问题描述】:
我一直被这个问题困扰:
我得到一个文本文件列表(例如“ZchEuxJ9VJ.txt”、“QAih70niIq.txt”),每个文件都包含一个随机生成的段落。我将编写一个解析器,它将从文件夹中列出的每个文件中提取单个单词。我的最终目标是创建一个字典,其中的键代表在我的文件中找到的各个单词。这些值应该是包含该单词的文件列表。例如,如果我打印('happy:', search['happy']),则应将包含单词happy 的文件作为值添加到我的字典中。如果这个词是一个“新”词,我将不得不第一次设置它。如果该词不是“新”词,我将不得不更新与该词关联的列表。我还必须确保不会将相同的文件名添加到同一个单词两次。
我已经创建了一个名为search 的新字典,访问了每个文件并打开它们进行阅读,然后使用split() 方法隔离每个单词。我正在努力解决的问题是如何“找到”特定文件中的单词并标记可以在哪个文件中找到单词。我尝试“搜索”文件中的单词然后将文件添加到字典中,但这会给我一条错误消息。
【问题讨论】:
-
您好,请使用tour,阅读How to Ask 以及如何创建minimal reproducible example。
标签: python