【发布时间】:2015-12-23 20:56:53
【问题描述】:
YCSB 的工作负载使用自动生成的数据。有没有办法附加 Twitter 或其他服务的公共数据集作为工作负载的输入?我需要使用这些数据集的因果关系。 (例如 {id, tweet, parent-id..}
【问题讨论】:
标签: twitter stream dataset benchmarking ycsb
YCSB 的工作负载使用自动生成的数据。有没有办法附加 Twitter 或其他服务的公共数据集作为工作负载的输入?我需要使用这些数据集的因果关系。 (例如 {id, tweet, parent-id..}
【问题讨论】:
标签: twitter stream dataset benchmarking ycsb
您不能在原版 YCSB 中使用,但您可以改用 KV-replay 分支。工作负载(跟踪)需要修改为它们的输入格式,但这在 Python 或 bash 中应该很容易做到。
【讨论】: