【发布时间】:2021-11-17 00:14:09
【问题描述】:
我有很多列或变量,但实际上我只是想知道一些列之间的相关性,因为它太多了。可能我可以将数据除以 5 倍。我使用这样的代码
plt.figure(figsize=(20, 20))
cmap = sns.diverging_palette(222, 10, as_cmap=True)
_ = sns.heatmap(df_new.corr(), annot=True, vmax=.8, square=True, cmap=cmap)```
输出是 是不是太多了? 如何将数据分成几列,例如 1 个热图的 25 列而不是 1 个热图相关的 120 个变量? 谢谢你帮助我!
【问题讨论】:
-
您实际上 寻找的似乎是PCA。但是你忘了问一个我们可以回答的问题!
-
抱歉我已经编辑了问题
标签: python seaborn data-visualization correlation