【发布时间】:2014-12-21 19:26:05
【问题描述】:
似乎我在 Pandas 中所做的很多事情在我拥有的数据量中具有凸计算时间成本(例如,1 行需要 1 秒,2 行需要 2.2 秒,4 行需要 6 秒,等等) .
为什么计算成本不会线性增加我拥有的数据量?比如我写的这个函数:
def fractrips1brand(trip):
# Get number of transaction rows for THIS sepcific consumer
art = trip[trip.Item_Id.isin(insidegood)].Item_Id.nunique()
output = pd.Series({'numinsidegoods': art })
return output
gr_TILPS = TILPStemp.groupby('uniqueid')
output = gr_TILPS.apply(fractrips1brand)
似乎表现出这样的成本。
为什么不是O(n)?
【问题讨论】:
-
我能有一个可运行的例子吗?
标签: python pandas computation