圆月山庄资源网 Design By www.vgjia.com
一、pandas分组
1、分组运算过程:split->apply->combine
- 拆分:进行分组的根据
- 应用:每个分组运行的计算规则
- 合并:把每个分组的计算结果合并起来
2、分组函数
DataFrame.groupby(by=None, axis=0, level=None, as_index=True, sort=True, group_keys=True, squeeze=False, observed=False, **kwargs
by: 依据哪些列进行分组,值可以是:mapping, function, label, or list of labels
3、聚合函数
4、分组聚合实例
单列分组
> import pandas as pd > df = pd.DataFrame({'A': ['a', 'b', 'a', 'c', 'a', 'c', 'b', 'c'], 'B': [2, 8, 1, 4, 3, 2, 5, 9], 'C': [102, 98, 107, 104, 115, 87, 92, 123], 'D': [2, 98, 17, 14, 15, 7, 92, 13]}) > df A B C D 0 a 2 102 2 1 b 8 98 98 2 a 1 107 17 3 c 4 104 14 4 a 3 115 15 5 c 2 87 7 6 b 5 92 92 7 c 9 123 13 > df.groupby(by='A').sum() B C D A a 6 324 34 b 13 190 190 c 15 314 34
多列分组
> df.groupby(by=['A','B']).sum() ###A,B成索引 C D A B a 1 107 17 2 102 2 3 115 15 b 5 92 92 8 98 98 c 2 87 7 4 104 14 9 123 13
多列聚合
> df.groupby(by=['A','B'])['C'].sum() ###1个列 A B a 1 107 2 102 3 115 b 5 92 8 98 c 2 87 4 104 9 123 > df.groupby(by=['A','B'])['C','D'].sum() ###2个列 C D A B a 1 107 17 2 102 2 3 115 15 b 5 92 92 8 98 98 c 2 87 7 4 104 14 9 123 13
多列不同聚合方式
> import numpy as np > df.groupby(by=['A']).agg({'C':[np.mean, 'sum'], 'D':['count',np.std]}) C D mean sum count std A a 108.000000 324 3 8.144528 b 95.000000 190 2 4.242641 c 104.666667 314 3 3.785939 >ps: 不同列使用多个不同函数进行聚合C: mean,sum;D:count,std
返回值类型区别
方法1:agg > df.groupby(by=['A']).agg({'C':[np.mean]}) C mean A a 108.000000 b 95.000000 c 104.666667 > type(df.groupby(by=['A']).agg({'C':[np.mean]})) <class 'pandas.core.frame.DataFrame'> 方法2:索引 > df.groupby(by=['A'])['C'].mean() A a 108.000000 b 95.000000 c 104.666667 Name: C, dtype: float64 > type(df.groupby(by=['A'])['C'].mean()) <class 'pandas.core.series.Series'> 总结: 两种方法结果一样,但是一个类型是DataFrame,一个为Series;有时候会用上
二、pandas排序
按索引进行降序排列
> df A B C D 0 a 2 102 2 1 b 8 98 98 2 a 1 107 17 3 c 4 104 14 4 a 3 115 15 5 c 2 87 7 6 b 5 92 92 7 c 9 123 13 > df.sort_index(ascending=False) ### 索引 A B C D 7 c 9 123 13 6 b 5 92 92 5 c 2 87 7 4 a 3 115 15 3 c 4 104 14 2 a 1 107 17 1 b 8 98 98 0 a 2 102 2
按值进行降序排列
> df.sort_values(by="A",ascending=False) # 按某一列 A B C D 3 c 4 104 14 5 c 2 87 7 7 c 9 123 13 1 b 8 98 98 6 b 5 92 92 0 a 2 102 2 2 a 1 107 17 4 a 3 115 15 > df.sort_values(by=["B","A"],ascending=False) # 按2列 A B C D 7 c 9 123 13 1 b 8 98 98 6 b 5 92 92 3 c 4 104 14 4 a 3 115 15 5 c 2 87 7 0 a 2 102 2 2 a 1 107 17
以上就是本文的全部内容,希望对大家的学习有所帮助,也希望大家多多支持。
圆月山庄资源网 Design By www.vgjia.com
广告合作:本站广告合作请联系QQ:858582 申请时备注:广告合作(否则不回)
免责声明:本站文章均来自网站采集或用户投稿,网站不提供任何软件下载或自行开发的软件! 如有用户或公司发现本站内容信息存在侵权行为,请邮件告知! 858582#qq.com
免责声明:本站文章均来自网站采集或用户投稿,网站不提供任何软件下载或自行开发的软件! 如有用户或公司发现本站内容信息存在侵权行为,请邮件告知! 858582#qq.com
圆月山庄资源网 Design By www.vgjia.com
暂无评论...
稳了!魔兽国服回归的3条重磅消息!官宣时间再确认!
昨天有一位朋友在大神群里分享,自己亚服账号被封号之后居然弹出了国服的封号信息对话框。
这里面让他访问的是一个国服的战网网址,com.cn和后面的zh都非常明白地表明这就是国服战网。
而他在复制这个网址并且进行登录之后,确实是网易的网址,也就是我们熟悉的停服之后国服发布的暴雪游戏产品运营到期开放退款的说明。这是一件比较奇怪的事情,因为以前都没有出现这样的情况,现在突然提示跳转到国服战网的网址,是不是说明了简体中文客户端已经开始进行更新了呢?
更新日志
2024年11月05日
2024年11月05日
- 雨林唱片《赏》新曲+精选集SACD版[ISO][2.3G]
- 罗大佑与OK男女合唱团.1995-再会吧!素兰【音乐工厂】【WAV+CUE】
- 草蜢.1993-宝贝对不起(国)【宝丽金】【WAV+CUE】
- 杨培安.2009-抒·情(EP)【擎天娱乐】【WAV+CUE】
- 周慧敏《EndlessDream》[WAV+CUE]
- 彭芳《纯色角3》2007[WAV+CUE]
- 江志丰2008-今生为你[豪记][WAV+CUE]
- 罗大佑1994《恋曲2000》音乐工厂[WAV+CUE][1G]
- 群星《一首歌一个故事》赵英俊某些作品重唱企划[FLAC分轨][1G]
- 群星《网易云英文歌曲播放量TOP100》[MP3][1G]
- 方大同.2024-梦想家TheDreamer【赋音乐】【FLAC分轨】
- 李慧珍.2007-爱死了【华谊兄弟】【WAV+CUE】
- 王大文.2019-国际太空站【环球】【FLAC分轨】
- 群星《2022超好听的十倍音质网络歌曲(163)》U盘音乐[WAV分轨][1.1G]
- 童丽《啼笑姻缘》头版限量编号24K金碟[低速原抓WAV+CUE][1.1G]