【发布时间】:2012-07-26 03:28:15
【问题描述】:
我必须使用时间序列进行科学实验。
我打算使用MySQL作为数据存储平台。
我正在考虑使用以下一组表来存储数据:
Table1 --> ts_id(存储时间序列索引,我要处理好几个时间序列)
Table2 --> ts_id, obs_date, value(应该被{ts_idx,obs_date}索引)
因为会有很多时间序列(数百个),每个可能有数百万个观测值,表 2 可能会变得非常大。
问题是我必须多次重复这个实验,所以我不确定最好的方法是什么:
- 将
experiment_id添加到表中,让它们进一步增长。 - 为每个实验创建一个单独的数据库。
如果选项 2 更好(我个人认为是这样),那么执行此操作的最佳逻辑方法是什么?我有许多不同的实验要执行,每个都需要复制。如果我为每个复制创建不同的数据库,我很快就会获得数百个数据库。有没有办法在逻辑上组织它们,例如将每个复制作为其实验master database的“子数据库”?
【问题讨论】:
-
你看过HDF5吗?见for details。
标签: mysql database time-series