【发布时间】:2021-06-21 16:44:00
【问题描述】:
我是 Pandas 的新手,我正在尝试使用它来清理由索引、艺术作品标题和艺术作品维度组成的数据库。
我拥有的是:
db1 = {'title' : ['121 art1 magic world 100x82 2000.jpg', '383 art2 fantastic comic 61x61 2017.jpg']}
我需要的是
db2 = {'index': [121,383],
'title' : ['art1 magic world', 'art2 fantastic comic'],
'dimension': ['100x82','61x61']
'year': [2000, 2017]
我没有成功的尝试:
-
str.split(expand=True)方法,在df = pd.DataFrame(dict)上,但我对标题由许多单词组成的事实感到困惑。 -
.replace()清理df['title']的方法,但我确信这是一个最佳实践。
你能帮忙吗? 提前致谢。
【问题讨论】:
-
是否总是有 2 件事要索引或任何数字?对于这项工作,我认为使用 pandas 没有任何优势。简单的 python 列表和字典应该可以。