【发布时间】:2021-09-05 00:39:36
【问题描述】:
我有一个这样的字典列表:
myList = [
{
'id':1,
'text':['I like cheese.',
'I love cheese.', 'oh Ilikecheese !'],
'text_2': [('david',
'david',
'I do not like cheese.'),
('david',
'david',
'cheese is good.')]
},
{
'id':2,
'text':['I like strawberry.', 'I love strawberry'],
'text_2':[('alice',
'alice',
'strawberry is good.'),
('alice',
'alice',
' strawberry is so so.')]
}
]
我想删除超过一定字母数(例如 9 个字母)的单词。
理想的输出是相同的字典列表,但删除拼写错误的单词,例如删除“Ilikecheese”:
myList = [
{
'id':1,
'text':['I like cheese.',
'I love cheese.', 'oh!'],
'text_2': [('david',
'david',
'I do not like cheese.'),
('david',
'david',
'cheese is good.')]
},
{
'id':2,
'text':['I like strawberry.', 'I love strawberry'],
'text_2':[('alice',
'alice',
'strawberry is good.'),
('alice',
'alice',
' strawberry is so so.')]
}
]
有什么建议吗?
【问题讨论】:
-
进行列表理解,省略您不想要的单词。
newtext = [word for word in text if len(word) <= 9] -
@j1-lee 感谢您的建议,我修改了问题
-
究竟是什么阻碍了您编写代码来解决问题,就目前而言?您对代码需要如何工作有什么想法,以及您无法编写代码的哪一部分?如果您编写了代码,请展示代码并解释您尝试它时发生的情况以及与预期发生的情况有何不同。另外,为什么这被标记为
tokenize?你真的不知道如何将字符串拆分成单词吗? -
请阅读How to Ask 并注意you are expected to make some attempt to solve the problem yourself。 Stack Overflow 不是代码编写服务,"any suggestions?" is not an actual question;你需要更具体。
标签: python string list dictionary tokenize