【发布时间】:2015-07-29 16:11:04
【问题描述】:
我正在寻找一种方法来使用 R 找到与主题属性最接近的可比房地产销售。我需要输出包含不同变量之间的距离。
我尝试过使用dist 函数,但它会产生一个输出,比较矩阵中的所有行。理想情况下,我想将单个主题与销售列表与按最接近匹配排序的输出与列出的每个变量的距离进行比较。
示例数据;
销售
parcel square_feet age quality
R100 2500 10 4
R200 1800 15 3
R300 2200 8 5
主题
R400 1900 14 4
理想情况下我想输出这样的东西
parcel sq_ft_dist age_dist qual_dist
R200 100 1 1
R300 300 6 1
R100 600 4 0
编辑 我正在寻找包裹之间的欧几里得距离。
编辑2
为了澄清我的问题,我可以使用 dist 函数获得每行之间的欧几里得距离。它为矩阵中的每一对返回一个值。太好了,但这超出了我的需要,对于大数据集,输出矩阵可能会变得非常大。我只需要主题和其他行之间的距离。我想我可以从dist 的输出中提取我感兴趣的距离,然后手动计算变量之间的距离。我在问,希望有一个 R 函数已经可以做到这一点。
【问题讨论】:
-
您似乎有三个距离(平方英尺、年龄和质量)。您在订购时如何结合这三个距离?
-
是的,除非您定义它,否则您不能按“最近”排序。
-
对不起,我的意思是欧几里得距离度量,就像 dist() 使用的一样。
标签: r