【发布时间】:2021-08-30 06:51:45
【问题描述】:
我想通过移除它们之间的拟合线来移除两个变量 X 和 Y 之间的相关性。我的土气代码如下:
X = pd.read_csv (r'C:\Users\folder\X.csv')
X = pd.DataFrame(X,columns=['Year','Jan','Feb','Mar','Apr','May','Jun','Jul','Aug','Sep','Oct','Nov','Dec'])
X X[X['Year'].between(1984,2020, inclusive="both")]
Y = pd.read_csv (r'C:\Users\folder\Y.csv')
Y = pd.DataFrame(Y,columns=['Year','Jan','Feb','Mar','Apr','May','Jun','Jul','Aug','Sep','Oct','Nov','Dec'])
Y=Y[Y['Year'].between(1984,2020, inclusive="both")]
我想通过从 X 中删除其相关性将 Y 转换为 new_Y。我只对删除“Mar”中的相关性感兴趣。我正在使用 jupyter notebook,我对 python 或任何其他编程语言都很陌生。提前致谢。
This is the data. I used 1984-2020 only when I read the .csv
【问题讨论】:
-
您能否添加一个示例来说明数据的外观?此外,您是否对从变量中减去最佳拟合线感兴趣?这并不是消除相关性的最佳方式。
-
1.我不知道如何在这里添加数据。 2.是的,我想从X中减去Y的数据。
标签: python regression jupyter