【问题标题】:Import dot in xlsx as missing value in Stata将 xlsx 中的点作为 Stata 中的缺失值导入
【发布时间】:2017-10-17 18:54:17
【问题描述】:

我有一张 Excel 表格作为 Stata 的输入。在 Excel 中,单元格中的点表示缺失值,例如:

Column1 Column2
1       10
2       .
.       13
.       15
3       .

但是,在将 Excel 导入 Stata 时,上面的两列都被标识为字符串。

如何在导入期间告诉 Stata 所有点都应被识别为缺失值,因此我的数字列仍然是数字,尽管它们包含一些点/缺失值?

【问题讨论】:

  • 你没有说你正在使用什么样的文件中的import 命令。但在 Stata 中,这种设置 destring, replace 是一种解决方案。

标签: import stata xlsx


【解决方案1】:

假设您可能从 Excel 或 csv 导入。

Excel 来自import excel 指导: 如果列包含至少一个非数字文本的单元格,则将整列作为字符串变量导入。

所以最简单的解决方案是: destring 变量。您可以通过destring 一次性完成整个列表:

destring var_1 var_2 var_3, replace

这会将变量覆盖为数字变量和 .将被编码为缺失。

导入 CSV 就像在 Excel 中一样,如果有非数字字符,我相信 Stata 会认为它可能是一个字符串。导入时可以使用numericcols 选项

import delimited, numericcols() 

然后,您在 numericcols 选项中指定的任何列都将被强制为数字,并且 .应该被解释为缺失。

如上所述,destring 也同样简单。

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2013-07-21
    • 1970-01-01
    相关资源
    最近更新 更多