【问题标题】:Statistical analysis of .h5 files (SPSS?).h5 文件的统计分析(SPSS?)
【发布时间】:2014-04-21 14:30:34
【问题描述】:

我在单独的 .h5 文件(分层数据格式 5,HDF5)中有两组数据,使用 python 脚本获得,我想执行统计分析以找出它们之间的相关性。我在这里的经验是有限的;我不知道任何R。

我想将数据加载到 SPSS,但 SPSS 似乎不支持 .h5。去这里的最佳方式是什么?我可以将所有内容写入 .csv 文件,但我会丢失变量的名称。有没有办法在不丢失任何信息的情况下转换数据?为什么 SPSS 不支持 h5?

我知道 Rpy 模块的存在。你认为学习 R 编程值得吗?这会给我提供与 SPSS 中相同的方法库吗?

感谢您的意见!

【问题讨论】:

  • 你可以使用pandas直接在python中进行统计分析,使用pytables也支持开箱即用的HDF。

标签: python r hdf5 statistics h5py


【解决方案1】:

有没有办法在不丢失任何信息的情况下转换数据?

如果 HDF5 数据足够规则,您可以将其加载到 Python 或 R 中,然后将其再次保存为 CSV(如果您更喜欢冒险和/或关心性能,甚至可以使用 SPSS .sav 格式)。

为什么 SPSS 还是不支持 h5?

谁知道呢。它可能应该。哦,好吧。

你认为学习 R 编程值得吗?

如果您发现 SPSS 有用,那么您可能还会发现 R 有用。既然您提到了 Python,您可能会发现它也很有用,但它更像是一种通用语言:更灵活,但不太关注数学和统计数据。

R 会给我提供与 SPSS 中相同的方法库吗?

可能,具体取决于您在做什么。 R 包含大多数数学和统计数据,包括可安装包中的一些相当深奥和/或新算法。它有一些 Python (目前)没有的东西,但 Python 也涵盖了许多用户的大部分基础。

【讨论】:

  • 这是关于 R 和 Python 的功能奇偶性的非常强烈的主张,可以很容易地在其他方向上恢复。
猜你喜欢
  • 1970-01-01
  • 2015-10-15
  • 2016-05-06
  • 1970-01-01
  • 1970-01-01
  • 2013-06-25
  • 1970-01-01
  • 2018-07-03
  • 2011-02-22
相关资源
最近更新 更多