【发布时间】:2021-07-25 16:24:19
【问题描述】:
我有大约 10,000 个符号的 5 年分钟柱,作为 CSV 文件。它总共有大约 50GB 的文本。我的内存是 32GB。
我正在尝试将所有这些数据加载到 KDB 表中,以便轻松查询。
symbols: `$(-4_')(string') key `:/home/chris/sync/us_equities
f: {`$(":/home/chris/sync/us_equities/", x, ".csv")}
load_symbol: {(0!(update "P"$-1_/:t, s: x from flip `t`o`h`l`c`v!("*FFFFI";",")0: f(string x))) }
({`:/home/chris/sync/price_data insert (load_symbol x)}) each symbols
- 我应该使用简单的表,还是应该使用分区/splays?
- 我将代码添加为符号类型的额外列;对吗?
- 最后一行
insert非常缓慢。看起来需要大约一天的时间来处理,也许更长。我该如何优化它?我试过peach,但这更慢。看起来它开始非常快,并且随着each的每一步而变慢。
谢谢!
【问题讨论】:
标签: kdb