【发布时间】:2020-07-01 11:59:00
【问题描述】:
我在 csv 中有几个数据点,如下所示:
date value
0 8/1/2019 0.243902
1 8/17/2019 0.322581
2 9/1/2019 0.476190
3 10/6/2019 0.322581
4 10/29/2019 0.476190
5 11/10/2019 0.526316
6 11/21/2019 1.818182
7 12/8/2019 2.500000
8 12/22/2019 3.076923
9 1/5/2020 3.333333
10 1/12/2020 3.333333
11 1/19/2020 0.000000
12 2/2/2020 0.000000
我想在第一个日期和最后一个日期之间的每个小时生成一个值(假设每个日期都从该日期的 00:00 开始),以便生成的值在每个现有数据点之间创建一条相当平滑的曲线。如果可能的话,我还想为生成的值添加少量随机变化,以使曲线不是完全平滑。我最终希望将这个新数据集输出到一个 csv 中,其中包含相同的两列,其中包含原始行以及生成的值及其关联的日期时间(每个都在自己的行中)。
有没有办法轻松生成这些点并将结果输出到 csv?到目前为止,我已经尝试使用 pandas 来存储数据,但我无法找到一种方法来确保生成的数据考虑到现有数据点。
【问题讨论】:
标签: python-3.x pandas dataframe