【问题标题】:Find least frequently occurring character in a column in dataframe在数据框中的列中查找最不频繁出现的字符
【发布时间】:2021-05-12 03:57:14
【问题描述】:

我正在使用 nycflights13 包中的平面数据集。我想在 planes 数据集中找到 Find the most most most most利率erted From Tailnum 列。

我尝试使用 str_split & boundary() 但不知道如何继续

 library(tidyverse)
 library(nycflights13)
 planes<- nycflights13::planes

 strsplit(word(planes$tailnum),boundary("character")) 

【问题讨论】:

    标签: r dplyr tidyverse stringr


    【解决方案1】:

    将每个单词拆分为字符,使用tablesort 计数并选择第一个值。

    sort(table(unlist(strsplit(planes$tailnum, ''))))[1]
    
    #G 
    #9 
    

    或者使用tidyverse

    library(dplyr)
    library(tidyr)
    
    planes %>%
      separate_rows(tailnum, sep = '') %>%
      filter(tailnum != '') %>%
      count(tailnum) %>%
      slice_min(n, n = 1)
    
    #  tailnum     n
    #  <chr>   <int>
    #1 G           9
    

    【讨论】:

    • 谢谢,如果是最少出现的单词,那就完美了,我们该怎么做呢
    • 对于可以在空格上拆分的单词。像这样的东西 - sort(table(unlist(strsplit(planes$tailnum, ' '))))[1]
    • 完成了,我过去都做过,不知怎的错过了这个。感谢整洁的回答方式
    猜你喜欢
    • 2015-10-08
    • 2022-06-15
    • 1970-01-01
    • 2014-10-31
    • 1970-01-01
    • 1970-01-01
    • 2022-08-16
    • 1970-01-01
    • 2018-10-01
    相关资源
    最近更新 更多