温馨提示×

温馨提示×

您好,登录后才能下订单哦!

密码登录×
登录注册×
其他方式登录
点击 登录注册 即表示同意《亿速云用户服务条款》

R语言列筛选的方法select怎么使用

发布时间:2022-09-05 17:17:52 来源:亿速云 阅读:761 作者:iii 栏目:开发技术

这篇文章主要介绍了R语言列筛选的方法select怎么使用的相关知识,内容详细易懂,操作简单快捷,具有一定借鉴价值,相信大家阅读完这篇R语言列筛选的方法select怎么使用文章都会有所收获,下面我们一起来看看吧。

    1. 数据描述

    数据来源是我编写的R包learnasreml中的fm数据集。

    r$> library(learnasreml)
    
    r$> data(fm)
    
    r$> head(fm)

    R语言列筛选的方法select怎么使用

    我们的目的:

    提取fm的TreeID,Rep,dj,dm,h4,并重命名为:ID, F1, y1 , y2, y3

    2. 使用R语言默认的方法:列选择

    这一种,当然是简单粗暴的方法,想要哪一列,就把相关的列号提取出来,形成一个向量,进行操作即可。比如

    r$> d1 = fm[,c(1,3,6,7,11)]
    
    r$> head(d1)
      TreeID Rep    dj    dm  h4
    1  80001   1 0.334 0.405 239
    2  80002   1 0.348 0.393 242
    3  80004   1 0.354 0.429 180
    4  80005   1 0.335 0.408 301
    5  80008   1 0.322 0.372 271
    6  80026   1 0.359 0.450 258
    
    r$> names(d1) = c("ID","F1","y1","y2","y3")
    
    r$> head(d1)

    结果:

    R语言列筛选的方法select怎么使用

    缺点:

    这种方法,需要找到性状所在的列号,然后还要重命名,比较麻烦。

    而且,后面如果想要根据列的特征进行提取时(比如以h开头的列,比如属性为数字或者因子的列等等),就不能实现了。

    这就要用到tidyverse的函数了,selectrename,都是一等一的良将。

    3. tidyverse的rename函数

    代码:

    a2 = fm %>% rename(ID=TreeID, F1 = Rep, y1 = dj, y2 = dm, y3 = h4)

    R语言列筛选的方法select怎么使用

    这里,rename只是单独的修改名称,并没有提取出来。

    还要使用select进一步的提取:

    R语言列筛选的方法select怎么使用

    4. tidyverse的select函数

    如果使用select函数,一行代码就可以搞定:

    a1 = fm %>% select(ID=TreeID, F1 = Rep, y1 = dj, y2 = dm, y3 = h4)

    R语言列筛选的方法select怎么使用

    5. select函数注意事项

    常见的坑:

    注意,MASS包中也有select函数,而且优先级更高,如果你载入了MASS包,select就不能使用了。

    R语言列筛选的方法select怎么使用

    哪怕你再次载入tidyverse包,也不行:

    R语言列筛选的方法select怎么使用

    载入dplyr包,也不行:

    R语言列筛选的方法select怎么使用

    MASS就是这么豪横。

    像这种情况,解决办法有两种:

    5.1 绝对引用函数

    即使用select时,要用dplyr::select

    a3 = a2 %>% dplyr::select(ID,F1,y1,y2,y3)

    R语言列筛选的方法select怎么使用

    这样也比较麻烦。

    5.2 放到环境变量中

    推荐的方法:

    r$> select = dplyr::select
    
    r$> a3 = a2 %>% select(ID,F1,y1,y2,y3)

    R语言列筛选的方法select怎么使用

    推荐在载入包时,将下面代码放在开头,就可以肆无忌惮的应用select了,毕竟,环境变量的优先级是第一位的。

    library(tidyverse)
    select = dplyr::select

    6. 提取h开头的列

    这里,用starts_with,会匹配开头为h的列。

    其它还有contains,匹配包含的字符,还有end_with,匹配结尾的字符。

    应有尽有,无所不有。

    re1 = fm %>% select(starts_with("h"))

    R语言列筛选的方法select怎么使用

    7. 提取因子和数字的列

    匹配数字的列:

    re2 = fm %>% select_if(is.numeric)

    R语言列筛选的方法select怎么使用

    匹配为因子的列:

    re3 = fm %>% select_if(is.factor)

    R语言列筛选的方法select怎么使用

    关于“R语言列筛选的方法select怎么使用”这篇文章的内容就介绍到这里,感谢各位的阅读!相信大家对“R语言列筛选的方法select怎么使用”知识都有一定的了解,大家如果还想学习更多知识,欢迎关注亿速云行业资讯频道。

    向AI问一下细节

    免责声明:本站发布的内容(图片、视频和文字)以原创、转载和分享为主,文章观点不代表本网站立场,如果涉及侵权请联系站长邮箱:is@yisu.com进行举报,并提供相关证据,一经查实,将立刻删除涉嫌侵权内容。

    AI