【问题标题】:Error: `labels` must be unique for SPSS to R conversion错误:对于 SPSS 到 R 的转换,`labels` 必须是唯一的
【发布时间】:2021-04-10 22:46:30
【问题描述】:

我下载了以下文件(DS43 Election Returns for New York, 1885-1906): https://www.icpsr.umich.edu/web/ICPSR/studies/1/datadocumentation#

我尝试在 R 中打开它:

data <- "00001-0042-Data.txt"

data_setup <- "00001-0042-Setup.sps"
data <- asciiSetupReader::read_ascii_setup(
  data = data,
  setup_file = data_setup)

但我在 R 中收到以下错误:

Error: `labels` must be unique

我尝试查看 SPS 文件中的“变量标签”列表,方法是将其粘贴到 Excel 中,用空格分隔,并以这种方式识别重复项。到目前为止,我能够识别出五个重复项:

  • 858 3 G CONG 0100 投票
  • 870 3 G CONG 0200 投票
  • 874 3 G CONG 0100 投票
  • 878 3 G CONG 0320 投票
  • 878 3 S CONG 0320 投票

我将 1 放在变量的第二个实例旁边(稍后我可以检查变量是否相同时将其删除)但我仍然收到“错误:labels 必须是唯一的”错误。

有没有更有效的方法来检查重复标签,还是我忽略了什么?

【问题讨论】:

    标签: r duplicates label spss


    【解决方案1】:

    我不确定您的 id 列名称是什么,但 data %&gt;% group_by(id_name) %&gt;% summarise(count = n) %&gt;% arrange(count) 之类的名称应该将所有重复项放在顶部,以便您可以看到它们。例如,如果您想查看mpg 的哪些值在mtcars 中出现了多次,您可以运行:

    mtcars %>% 
      group_by(mpg) %>% 
      summarise(count = n()) %>% 
      arrange(-count)
    

    【讨论】:

      猜你喜欢
      • 2021-08-02
      • 2021-02-13
      • 2022-06-14
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2017-11-22
      • 1970-01-01
      • 2012-11-01
      相关资源
      最近更新 更多