【发布时间】:2014-03-14 00:53:53
【问题描述】:
我正在尝试将一个类传递给 iPython 以进行并行执行。实际上,此代码运行,但每次都加载“时区”。此类每次加载大约需要 10 秒,因此这种开销是不可接受的,除非它只发生一次,或者每个内核发生一次。 我对并行化很陌生,我现在想知道将导入移出函数。至少我认为这是正确的做法。
from IPython import parallel
clients = parallel.Client()
lview = clients.load_balanced_view()
lview.block = True
lats = [32.21, 34.98]
lons = [109.45, -102.4]
times = ['2014-03-12T16:20:44.000000000Z', '2014-03-12T15:48:52.000000000Z']
@lview.parallel()
def f(lats, lons, times):
import sys,os
sys.path.append("../utils/") # For grabbing 'Timezone'
import Timezone as Timezone
tz = Timezone.Timezone()
# Use tz to compute local time
a = tz.compute_local_time(lats, lons, times)
return a
%time f.map(lats, lons, times)
结果:
in sync results <function __call__ at 0x105d2db18>
CPU times: user 700 ms, sys: 232 ms, total: 932 ms
Wall time: 11.6 s
Out[15]:
[('Asia/Chongqing', '2014-03-13 00:20:44'),
('America/Chicago', '2014-03-12 10:48:52')]
如果我将输入数据的长度加倍,结果会在时间上加倍(大约 22 秒)。
如何传入tz 并让每个核心调用Timezone 方法。
【问题讨论】:
标签: parallel-processing ipython