【发布时间】:2019-07-30 16:20:27
【问题描述】:
我有一个数据集(称为“数据”),其中包含书籍列表以及用户在个人级别上对它们的评分(列 = 用户 ID、isbn、书名、书名)。
我想为一本书创建一般(汇总)评分和评分数量的新功能。然后我想修剪数据集以仅包含具有一定数量的评级的书籍。
我为评分数做的:
rating_count = data.groupby('Book-Title')['Book-Rating'].count().to_frame()
rating_count.rename(columns={'Book-Rating':'Rating-Count'}, inplace=True)
data = data.merge(rating_count, on='Book-Title', how='inner')
m = rating_count.quantile(.9) # trim threshols number
q_books = data.copy().loc[data['Rating-Count'] >= m] # new subsample
...最后一行引发
ValueError: 只能比较标签相同的 Series 对象
我们将不胜感激。谢谢。
【问题讨论】: