【发布时间】:2014-10-05 00:05:34
【问题描述】:
我正在考虑为我的 GAE 应用程序使用拼写检查器,我们已经有一个用于拼写检查的算法,但我正在尝试找出如何最好地存储和加载字典文件以获得最佳性能。
我正在考虑以下策略:
- 将字典数据放在本地应用引擎存储中的文本文件中,并使用标准 IO 方法(
open()、read()等)加载/读取它们 - 将字典数据放入 GCS 并使用 GCS IO 方法加载/读取
- 将字典数据放在
ndb.model()中并加载/缓存信息
我不太明白的一个缓存是上下文缓存——这个缓存是附加到给定实例的吗? IE。如果我有一个旋转的常驻实例,我可以继续将字典数据加载到实例的 RAM 中,因此访问数据应该非常快(微秒与毫秒的查找/获取时间)?字典数据可能是某种我们将针对性能进行优化的分片列表。是否还有其他我在这里没有考虑的可能更合适的数据存储方法/结构?谢谢。
【问题讨论】:
-
字典有多大?