【发布时间】:2015-12-05 00:23:26
【问题描述】:
我有一个非常大的数据集,包括 250 个字符串和数字变量。我想将一个接一个的列一起比较。例如,我将比较(差异)第一个变量与第二个变量,第三个变量与第四个变量,第五个变量与第六个变量,依此类推。
例如(数据集的结构类似于这个例子),我想比较 number.x 和 number.y,day.x 和 day.y,school.x 和 school.y 等等。
number.x<-c(1,2,3,4,5,6,7)
number.y<-c(3,4,5,6,1,2,7)
day.x<-c(1,3,4,5,6,7,8)
day.y<-c(4,5,6,7,8,7,8)
school.x<-c("a","b","b","c","n","f","h")
school.y<-c("a","b","b","c","m","g","h")
city.x<- c(1,2,3,7,5,8,7)
city.y<- c(1,2,3,5,5,7,7)
【问题讨论】:
-
你花哨的弯曲引号在传递给 R 时不起作用。此外,“比较”可能意味着任何东西。
-
与大多数编程语言不同,“.”不表示数据框或对象的成员:即 number.x 和 number.y 是 2 个完全不同的向量。当您说比较时,比较具体是什么?例如,如果您输入
number.y == number.x,您将获得一个与 number.x(或 number.y)长度相同的向量,其中 TRUE 和 FALSE 条目指示它们在哪里相等。这是你要找的吗? -
感谢您的回复。例如(对于数字) number.x 和 number.y 之间的差异是否为 0 。两个字符串列之间的比较也意味着我们是否有相同的元素。
-
请用您想要的结果修改您的问题。
-
例如:number.x
标签: r