【发布时间】:2022-12-16 09:42:03
【问题描述】:
我是 Pandas 的新手,正在处理 8000 行的数据集。这是它的 sn-p:
这些是一些线路。 (https://i.stack.imgur.com/8ftng.png) 我已经导入文件并将其命名为“df”。
我一直在尝试删除数据集中包含源文本链接的每一行。
到目前为止,这是我的代码:
def cleanLinks(col):
if re.search('http\S+', col):
return index(col)
df = df.drop(df.index[df['source'].apply(cleanLinks)])
我不知道从这里去哪里,所以非常感谢任何帮助。
【问题讨论】:
标签: python pandas csv data-analysis