【发布时间】:2014-05-28 20:49:47
【问题描述】:
我正在读取 .csv 文件并尝试执行以下操作:
- 从 V5 列中删除逗号,这是 190 个国家/地区的 gdp
- 求所有这些数字的平均值
这是我目前的代码:
gdp <- read.csv("GDP.csv", header = FALSE, stringsAsFactors = FALSE, skip=5, nrows=190)
x <- gsub(",", "", gdp$V5)
y <- as.numeric(x)
当我使用时
mean(y)
返回 NA 而不是平均值。我做错了什么?
源文件:https://d396qusza40orc.cloudfront.net/getdata%2Fdata%2FGDP.csv
【问题讨论】:
-
试试
mean(y, na.rm=TRUE) -
这行得通,但没有产生匹配的平均值(我正在尝试回答多项选择问题,并且选择的平均值与运行上述代码时得到的输出不匹配。跨度>
-
当我运行那个确切的脚本时,我得到以下信息:'code' Error: unexpected ']' in "x[is.na(as.numeric(as.character(x))]"
-
我没有收到
NA。我得到的意思是377652.4你的问题是什么意思?此外,如果您将在 Excel 中打开文件并检查前 190 行的平均值,它也会生成377652。所以你的问题有错误。 -
@MrFlick 你还需要一个关闭
):x[is.na(as.numeric(as.character(x)))]