【问题标题】:Stretch or compress pandas data frame columns linearly线性拉伸或压缩熊猫数据框列
【发布时间】:2021-12-16 22:56:12
【问题描述】:

我有一组 csv 文件上传到数据框中。每个文件都有不同的长度。

我想将所有列的长度与平均列长度相等。我不想只在最后添加值,但我想线性拉伸或压缩(如果它比平均值短或长)列 - 这意味着我想在列本身内插入(或删除)值。

有什么建议吗?

谢谢

【问题讨论】:

  • 你想如何推断你的数据?

标签: python pandas dataframe data-science


【解决方案1】:

尝试下面的代码并检查this answer 以了解如何推断您的值:

import pandas as pd
import pathlib

data = []
for filename in pathlib.Path('.').glob('*.csv'):
    df = pd.read_csv(filename)
    data.append(df)

mean_len = sum(len(df) for df in data) // len(data)

for idx, df in enumerate(data):
   if len(df) > mean_len
       data[idx] = df[:mean_len]
   else:
       # do stuff here to extrapolate your data
       # check https://stackoverflow.com/a/35959909/15239951

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2020-06-03
    • 2018-10-25
    • 2020-11-29
    • 2019-07-13
    • 1970-01-01
    相关资源
    最近更新 更多