R语言实现对数据框按某一列分组求组内平均值

 更新时间:2021年03月16日 15:48:26   作者:faith默默  
这篇文章主要介绍了R语言实现对数据框按某一列分组求组内平均值,具有很好的参考价值,希望对大家有所帮助。一起跟随小编过来看看吧

可使用aggregate函数

如:

aggregate(.~ID,data=这个数据框名字,mean) 

如果是对数据框分组,组内有重复的项,对于重复项保留最后一行数据用:

pcm_df$duplicated <- duplicated(paste(pcm_df$OUT_MAT_NO, pcm_df$Posit, sep = "_"), fromLast = TRUE)
pcm_df <- subset(pcm_df, !duplicated)
pcm_df$duplicated <- NULL

补充:R语言分组求和,分组求平均值,分组计数

我们经常可能需要把一个数据按照某一属性分组,然后计算一些统计值。在R语言里面,aggregate函数就可以办到。

## S3 method for class 'data.frame'
aggregate(x, by, FUN, ..., simplify = TRUE, drop = TRUE)

我们常用到的参数是:x, by, FUN。

x, 你想要计算的属性或者列。

by, 是一个list,可以指定一个或者多个列作为分组的基础。

FUN, 指定一个函数,用来计算,可以作用在所有分组的数据上面。

假如这个是我们的数据。

type<-c("a","b","c","a","c","d","b","a","c","b")
value<-c(53,15,8,99,76,22,46,56,34,54)
df<-data.frame(type,value)
df
  type value
1   a  53
2   b  15
3   c   8
4   a  99
5   c  76
6   d  22
7   b  46
8   a  56
9   c  34
10  b  54

分组求和

 aggregate(df$value, by=list(type=df$type),sum)
 type  x
1  a 208
2  b 115
3  c 118
4  d 22

分组求平均值

分组求平均很简单,只要将上面的sum改成mean就可以了。

aggregate(df$value, by=list(type=df$type),mean)
 type    x
1  a 69.33333
2  b 38.33333
3  c 39.33333
4  d 22.00000

分组计数

分组计数就是在分组的情况下统计rows的数目。

aggregate(df$value, by=list(type=df$type),length)
 type x
1  a 3
2  b 3
3  c 3
4  d 1

基于多个属性分组求和。

我们在原有的数据上加上一列,可以看看多属性分组。

type_2 <-c("F","M","M","F","F","M","M","F","M","M")
df <- data.frame(df, type_2)
df
  type value type_2
1   a  53   F
2   b  15   M
3   c   8   M
4   a  99   F
5   c  76   F
6   d  22   M
7   b  46   M
8   a  56   F
9   c  34   M
10  b  54   M


aggregate(x=df$value, by=list(df$type,df$type_2),sum)
 Group.1 Group.2  x
1    a    F 208
2    c    F 76
3    b    M 115
4    c    M 42
5    d    M 22

以上为个人经验,希望能给大家一个参考,也希望大家多多支持脚本之家。如有错误或未考虑完全的地方,望不吝赐教。

相关文章

  • R语言中其它对象知识点总结

    R语言中其它对象知识点总结

    在本篇文章里小编给大家分享的是一篇关于R语言中其它对象知识点总结内容,有需要的朋友们可以学习下。
    2021-03-03
  • R语言boxplot函数深入讲解

    R语言boxplot函数深入讲解

    这篇文章主要介绍了R语言boxplot函数深入讲解,文中图文讲解的很透彻,有感兴趣的同学可以研究下
    2021-03-03
  • R语言对二进制文件操作详解

    R语言对二进制文件操作详解

    在本篇内容里小编给大家整理的是一篇关于R语言二进制文件操作实例内容,有兴趣的朋友们可以学习下。
    2021-05-05
  • R语言中set.seed()函数的作用详解

    R语言中set.seed()函数的作用详解

    set.seed()括号里面的参数可以是任意数字,是代表你设置的第几号种子而已,不会参与运算,是个标记而已。,这篇文章主要介绍了R语言中set.seed()函数的作用,需要的朋友可以参考下
    2022-09-09
  • R语言交叉验证的实现代码

    R语言交叉验证的实现代码

    这篇文章主要介绍了R语言交叉验证的实现,本文通过示例代码给大家介绍的非常详细,对大家的学习或工作具有一定的参考借鉴价值,需要的朋友可以参考下
    2021-03-03
  • R语言数可视化Split violin plot小提琴图绘制方法

    R语言数可视化Split violin plot小提琴图绘制方法

    这篇文章主要为大家介绍了R语言数可视化Split violin plot小提琴图绘制方法,有需要的朋友可以借鉴参考下,希望能够有所帮助,祝大家多多进步
    2022-02-02
  • R包clusterProfiler如何安装成功(新手必看!)

    R包clusterProfiler如何安装成功(新手必看!)

    最近在我以为ClusterProfiler已经安装好的时候,又遇到了一些问题,所以这篇文章主要给大家介绍了关于R包clusterProfiler如何安装成功的相关资料,需要的朋友可以参考下
    2023-02-02
  • R语言 小数点位数的设置方式

    R语言 小数点位数的设置方式

    这篇文章主要介绍了R语言 小数点位数的设置方式,具有很好的参考价值,希望对大家有所帮助。一起跟随小编过来看看吧
    2021-03-03
  • 详解R语言实现前向逐步回归(前向选择模型)

    详解R语言实现前向逐步回归(前向选择模型)

    本文主要介绍了详解R语言实现前向逐步回归,从实现原理开始,文中通过示例代码介绍的非常详细,具有一定的参考价值,感兴趣的小伙伴们可以参考一下
    2021-08-08
  • R语言绘图数据可视化Ridgeline plot山脊图画法

    R语言绘图数据可视化Ridgeline plot山脊图画法

    这篇文章主要为大家介绍了R语言绘图数据可视化Ridgeline plot山脊图画法的示例详解,有需要的朋友可以借鉴参考下,希望能够有所帮助
    2022-02-02

最新评论