【发布时间】:2018-01-20 16:18:43
【问题描述】:
我有下表:
由于“位置”列中的状态重复,我试图从位置中删除状态,以便它只有城市名称。
year location state success
2009 New York, NY NY 1
2009 New York, NY NY 1
2009 Chicago, IL IL 1
2009 New York, NY NY 1
2009 Boston, MA MA 1
2009 Long Beach, CA CA 1
2009 Atlanta, GA GA 1
我已经尝试了以下代码:
x = KS_clean.column(1)
np.chararray.split(x, ',')
如何拆分字符串,使结果只包含城市名称,如下所示:
array('New York', 'New York', 'Chicago', ...,)
这样我可以把它放回桌子里吗?
对不起,这是一个基本问题,但我是 python 新手,还在学习。谢谢
【问题讨论】:
-
你的数据看起来像一个 pandas DataFrame,而不是一个 numpy 数组。请检查。
-
这是一个熊猫数据框,但是当我提取列 (var x) 并检查其类型时,它显示为 numpy.ndarray
-
您最初是如何获得数据框的?看起来很奇怪。当你选择一列时,你必须得到一个
Series,而不是任何numpy。