【发布时间】:2012-07-03 08:31:27
【问题描述】:
我将如何构建一个基于查询的 DataStoreInputReader(而不是读取该类型的每个实体)。基本原理是最小化读取(因为查询被索引到子集)和处理时间。
首先,这是个好主意吗? 还是会真正节省时间和处理时间 在使用查询支持的自定义数据存储输入读取器或将 查询本身取消 mapreduce 并行性或增加其他开销?
二,怎么做? 我一直在阅读 *input_readers.py* 和 目前尚不清楚如何将 AbstractDataStoreInputReader 子类化为 做这个。也许有人可以解释实施过程 像这样的东西,因为阅读代码并不清楚(和 文档已过时或不存在)。
对于那些可以指向显示自定义数据存储输入读取器实现的工作代码(github 或其他)的人来说,Brownie 点数。
这对于使 AppEngine MapReduce 更易于开发人员访问或更友好 ;-)
【问题讨论】:
标签: google-app-engine mapreduce