2021
03-30
03-30
R语言 实现data.frame 分组计数、求和等
df为1个data.frame对象,有stratum和psu两列,这里统计stratum列计数方法1:cnt=table(df$stratum)方法2:cnt=tapply(df$psu,INDEX=df$stratum,FUN=length)在方法2的基础上,只要改变FUN函数就可以实现分组求和、求均值等功能,如下分组求均值:tapply(df$psu,INDEX=df$stratum,FUN=mean)#(等价于python中的df.groupby('stratum').psu.mean)补充:R语言|自定义函数对数据集(data.frame)的列进行条件判断计算1.使用iri...
继续阅读 >
在对dataframe进行分析的时候会遇到需要分组计数,计数的column中属性有重复,但又需要仅对不重复的项计数(即重复N次出现的项只计1次)。函数如下:dataframe.groupby([‘分组的列名']).需要计数的列名.nunique()举例:数组“data”如下:StoreIDSalesSalesDateChannelA1002018/1/101A902018/1/102A110...