【发布时间】:2021-12-31 04:56:29
【问题描述】:
给定一个 ascii 文件,我想要一个 python one-liner 在文件中创建一个单词列表。
让 tfile 包含以下 2 行
abc xyz abc mno
tuv xyz qrs abc
文件中有 8 个单词和 5 个唯一单词。
如果我分配
file='tfile'
以下单行将创建一个包含 tfile 中 5 个唯一单词的集合
s=set(open(file).read().split())
输出是 {'abc', 'mno', 'qrs', 'tuv', 'xyz'}
但是,如果我尝试类似的方法来获取文件中所有单词的列表,即
l=list(open(file).read().split(" "))
我得到以下信息
['abc', 'xyz', 'abc', 'mno\ntuv', 'xyz', 'qrs', 'abc\n']
这不太有效,因为每行的最后一个单词都附加了一个换行符。
如果我将 strip() 添加到语句中
l=list(open(file).read().strip().split(" "))
我得到以下内容,这更好,但仍然包含一个换行符,该换行符附加到文件中下一行的第一个单词。
['abc', 'xyz', 'abc', 'mno', '\ntuv', 'xyz', 'qrs', 'abc']
所以 2 个问题: (1) 是否有一条线可以满足我的要求?和 (2) 为什么这组独特的单词可以很好地工作,没有任何换行符?
【问题讨论】:
-
在
split(' ')之前做.replace('\n', ' ' )用空格替换换行符 -
您是否在
split中添加了一个参数却没有注意到,或者这是您试图理解和修改的其他人的代码?