【发布时间】:2022-06-10 19:55:03
【问题描述】:
我刚刚开始研究熊猫。目前我正在研究 NETFLIX 的数据集。
在此数据集中,我想添加一个新列,其中包含该特定电影或电视节目中的演员总数。我可以单独计算演员阵容,但我想计算所有演员。有人可以帮我写这段代码吗? 这是我想要做的:
链接https://www.kaggle.com/datasets/shivamb/netflix-shows?
def set_cast(val):
if val is None:
return 0
if val == 'None':
return 0
return len(val.split(', '))
data['num_of_cast'] = data['cast'].apply(set_cast)
得到这些错误
return SeriesApply(self, func, convert_dtype, args, kwargs).apply() 'float' 对象没有属性 'split'
【问题讨论】:
-
请修改您的问题,使其更具可读性。还要添加您尝试过的代码,并准确说明您的问题是什么。 SO 社区通常不欢迎没有精心设计且尚未解决的问题。
-
data['cast']中有浮点值或 NaN。有一个提到的数据集的链接会很棒 -
谁能帮忙?
标签: pandas