【问题标题】:Filtering a data frame in R to drop data [duplicate]过滤R中的数据框以删除数据[重复]
【发布时间】:2020-09-15 03:17:29
【问题描述】:

我对 R 很陌生,我们必须做一个关于 covid-19 的项目。我下载了一个相当大的 csv 文件,其中包含超过 300.000 行关于国家、地区、城市的数据,以及某些活动从那里的基线减少或增加了多少。这是我的数据框结构的示例:

country_code       country_region sub_region_1 sub_region_2       date retail_rec groc_phar park transit work res
1            AE United Arab Emirates                           2020-02-15          0         4    5       0    2   1
2            AE United Arab Emirates                           2020-02-16          1         4    4       1    2   1
3            AE United Arab Emirates                           2020-02-17         -1         1    5       1    2   1
4            AE United Arab Emirates                           2020-02-18         -2         1    5       0    2   1
5            AE United Arab Emirates                           2020-02-19         -2         0    4      -1    2   1
6            AE United Arab Emirates                           2020-02-20         -2         1    6       1    1   1
7            AE United Arab Emirates                           2020-02-21         -3         2    6       0   -1   1
8            AE United Arab Emirates                           2020-02-22         -2         2    4      -2    3   1
9            AE United Arab Emirates                           2020-02-23         -1         3    3      -1    4   1
10           AE United Arab Emirates                           2020-02-24         -3         0    5      -1    3   1
11           AE United Arab Emirates                           2020-02-25         -3         2    3      -2    3   1
12           AE United Arab Emirates                           2020-02-26         -2         1   -3      -2    3   1
13           AE United Arab Emirates                           2020-02-27          1         5   -1      -1    3   1
14           AE United Arab Emirates                           2020-02-28          1         5   -1      -1    1   1
15           AE United Arab Emirates                           2020-02-29          2         7   -1      -1    5   0
16           AE United Arab Emirates                           2020-03-01          3        10    2      -1    4   1
17           AE United Arab Emirates                           2020-03-02          0         7    1      -2    4   1
18           AE United Arab Emirates                           2020-03-03          0         6    0      -5    4   1
19           AE United Arab Emirates                           2020-03-04         -1         7   -2      -5    3   2
20           AE United Arab Emirates                           2020-03-05         -3         6   -2      -5    3   2
21           AE United Arab Emirates                           2020-03-06         -7         5   -8      -9    0   3
22           AE United Arab Emirates                           2020-03-07         -3         6    1      -8    4   2
23           AE United Arab Emirates                           2020-03-08          1         8    6      -9   -1   3
24           AE United Arab Emirates                           2020-03-09         -3         4    4     -10   -1   4
25           AE United Arab Emirates                           2020-03-10         -4         6    3     -11   -2   4
26           AE United Arab Emirates                           2020-03-11         -4         5    0     -12   -2   4
27           AE United Arab Emirates                           2020-03-12         -8         6   -6     -15   -3   5            

我怎样才能创建一个新的数据框,而不是只包含来自我需要的 10 个国家/地区的数据?

【问题讨论】:

    标签: r database dataframe


    【解决方案1】:

    使用包dplyr 并假设您的数据框名为df

    ten_countries <- c("United Arab Emirates", "Xanadu", "Otherland", "Neverland")
    
    df %>%
      filter(country_region %in% ten_countries)
    

    如果country_region 不是正确的列,请选择正确的列。 ;-)

    【讨论】:

      猜你喜欢
      • 2020-04-03
      • 2021-12-08
      • 1970-01-01
      • 2017-03-18
      • 2021-11-09
      • 1970-01-01
      • 2013-06-20
      • 2016-11-02
      • 1970-01-01
      相关资源
      最近更新 更多