编程 Python

分享python数据统计的一些小技巧

Posted in Python onJuly 21, 2016

最近在用python做数据统计，这里总结了一些最近使用时查找和总结的一些小技巧，希望能帮助在做这方面时的一些童鞋。有些技巧是很平常的用法，平时我们没有注意，但是在特定场景，这些小方法还是能带来很大的帮助。

1.在字典中将键映射到多个值上面

{'b': [4, 5, 6], 
'a': [1, 2, 3]}

有时候我们在统计相同key值的时候，希望把所有相同key的条目添加到以key为键的一个字典中，然后再进行各种操作，这时候我们就可以使用下面的代码进行操作：

from collections import defaultdict
d = defaultdict(list)
print(d)
d['a'].append(1)
d['a'].append(2)
d['a'].append(3)
d['b'].append(4)
d['b'].append(5)
d['b'].append(6)
print(d)
print(d.get("a"))
print(d.keys())
print([d.get(i) for i in d])

这里是使用了collections中的方法，这里面还拥有很多有用的方法，我们有时间在继续进行深入了解。

上面代码运行结果：

defaultdict(, {})
defaultdict(, {'b': [4, 5, 6], 'a': [1, 2, 3]})
[1, 2, 3]
dict_keys(['b', 'a'])
[[4, 5, 6], [1, 2, 3]]

我们将数据填入之后，相当于进行快速分组，然后遍历每个组就可以统计一些我们需要的数据。

2.迅速转换字典键值对

data = {...}
zip(data.values(), data.keys())

data是我们的格式数据，使用zip后进行快速键值转换，然后可以使用max，min之类函数进行数据操作。

3.通过公共键对字典进行排序

from operator import itemgetter
data = [
  {'name': "bran", "uid": 101},
  {'name': "xisi", "uid": 102},
  {'name': "land", "uid": 103}
]
print(sorted(data, key=itemgetter("name")))
print(sorted(data, key=itemgetter("uid")))

数据格式就是data，我们想要对name或者uid进行排序我们就是用代码中的方法。
运行结果：

[{'name': 'bran', 'uid': 101}, {'name': 'land', 'uid': 103}, {'name': 'xisi', 'uid': 102}]
[{'name': 'bran', 'uid': 101}, {'name': 'xisi', 'uid': 102}, {'name': 'land', 'uid': 103}]

正如我们期望中的一样

4.对列表中的多个字典根据某一字段进行分组

注意注意，在进行分组前要首先对数据进行排序处理，排序字段根据实际要求来选择

即将处理的数据：

rows = [
  {'name': "bran", "uid": 101, "class": 13},
  {'name': "xisi", "uid": 101, "class": 11},
  {'name': "land", "uid": 103, "class": 10}
]

期望处理结果：

{
101: [{'name': 'xisi', 'class': 11, 'uid': 101},{'name': 'bran', 'class': 13, 'uid': 101}],
103: [{'name': 'land', 'class': 10, 'uid': 103}]
}

我们按照uid进行分组，这里只是演示，uid一般也不会重复。

这个比较复杂一点，我们一部一步来分解

some = [('a', [1, 2, 3]), ('b', [4, 5, 6])]
print(dict(some))

结果：

{'b': [4, 5, 6], 'a': [1, 2, 3]}

这里我们的目的是将元组转换成字典，这个很简单，应该都能看懂。接着我们来下一步对待处理数据进行排序：

data_one = sorted(rows, key=itemgetter("class"))
print(data_one)
data_two = sorted(rows, key=lambda x: (x["uid"], x["class"]))
print(data_two)

这里我们提供两种排序方式原理相同，只是样式稍有区别，第一种data_one是直接使用itemgetter，按照我们前面使用过得，直接按照某一字段进行排序，可是有时候我们会有另一种要求：

先按照某一字段排序，当第一字段重复时，再按照另一字段排序。

这时我们就用第二种方法，进行多字段值排序。
排序结果如下：

[{'name': 'land', 'class': 10, 'uid': 103}, {'name': 'xisi', 'class': 11, 'uid': 101}, {'name': 'bran', 'class': 13, 'uid': 101}]
[{'name': 'xisi', 'class': 11, 'uid': 101}, {'name': 'bran', 'class': 13, 'uid': 101}, {'name': 'land', 'class': 10, 'uid': 103}]

结果大家慢慢看一下，还是略有差别。

接下来就进行最后一步了，将我们刚才讲的两种方式结合起来使用：

data = dict([(g, list(k)) for g, k in groupby(data_two, key=lambda x: x["uid"])])
print(data)

我们对排序好的数据进行分组，然后生成元组列表，最后将其转换成字典，这里大功告成，我们成功将数据进行分组。

python数据统计的一些小技巧就分享到这，有需要的可以参考学习。

分享python数据统计的一些小技巧

- Author -

daisy

声明：登载此文出于传递更多信息之目的，并不意味着赞同其观点或证实其描述。

Python 相关文章推荐

python MySQLdb Windows下安装教程及问题解决方法

May 09 Python

详解Django框架中用户的登录和退出的实现

Jul 23 Python

Python三种遍历文件目录的方法实例代码

Jan 19 Python

python pyheatmap包绘制热力图

Nov 09 Python

Python Numpy库datetime类型的处理详解

Jul 13 Python

python3使用GUI统计代码量

Sep 18 Python

Python 类的魔法属性用法实例分析

Nov 21 Python

Django 解决新建表删除后无法重新创建等问题

May 21 Python

pandas数据处理之绘图的实现

Jun 15 Python

Python os库常用操作代码汇总

Nov 03 Python

Python读取pdf表格写入excel的方法

Jan 22 Python

python中print格式化输出的问题

Apr 16 Python

python中print的不换行即时输出的快速解决方法

Jul 20 #Python

Python全局变量用法实例分析

Jul 19 #Python

python对象及面向对象技术详解

Jul 19 #Python

python异常和文件处理机制详解

Jul 19 #Python

python线程、进程和协程详解

Jul 19 #Python

浅谈python字符串方法的简单使用

Jul 18 #Python

python读取oracle函数返回值

Jul 18 #Python

You might like

使用 eAccelerator加速PHP代码的方法

2007/09/30 PHP

PHP 获取文件权限函数介绍

2013/07/11 PHP

简单分析ucenter 会员同步登录通信原理

2014/08/25 PHP

zen cart实现订单中增加paypal中预留电话的方法

2016/07/12 PHP

深入了解PHP中的Array数组和foreach

2016/11/06 PHP

如何打开php的gd2库

2017/02/09 PHP

PHPStorm2020.1永久激活及下载更新至2020(推荐)

2020/09/25 PHP

javascript 兼容FF的onmouseenter和onmouseleave的代码

2008/07/19 Javascript

DOM下的节点属性和操作小结

2009/05/14 Javascript

单击按钮显示隐藏子菜单经典案例

2013/01/04 Javascript

JS 获取select(多选下拉)中所选值的示例代码

2013/08/02 Javascript

简单易用的倒计时js代码

2014/08/04 Javascript

jquery简单实现外部链接用新窗口打开的方法

2015/05/30 Javascript

JavaScript返回上一页的三种方法及区别介绍

2015/07/04 Javascript

基于insertBefore制作简单的循环插空效果

2015/09/21 Javascript

微信小程序实战之仿android fragment可滑动底部导航栏（4）

2020/04/16 Javascript

vue2.0+koa2+mongodb实现注册登录

2018/04/10 Javascript

vue-froala-wysiwyg 富文本编辑器功能

2019/09/19 Javascript

JavaScript 接口原理与用法实例详解

2020/05/12 Javascript

Vue.js桌面端自定义滚动条组件之美化滚动条VScroll

2020/12/01 Vue.js

[40:10]2015国际邀请赛全明星表演赛

2015/08/07 DOTA

python复制文件到指定目录的实例

2018/04/27 Python

python 爬虫一键爬取淘宝天猫宝贝页面主图颜色图和详情图的教程

2018/05/22 Python

对python的unittest架构公共参数token提取方法详解

2018/12/17 Python

使用Django搭建一个基金模拟交易系统教程

2019/11/18 Python

keras中模型训练class_weight,sample_weight区别说明

2020/05/23 Python

经理管理专业自荐信范文

2013/12/31 职场文书

学习十八大报告感言

2014/02/04 职场文书

理财学专业自荐书

2014/06/28 职场文书

国庆横幅标语

2014/10/08 职场文书

胡雪岩故居导游词

2015/02/06 职场文书

自主招生英文自荐信

2015/03/25 职场文书

班主任开场白

2015/06/01 职场文书

一看就懂的MySQL的聚簇索引及聚簇索引是如何长高的

2021/05/25 MySQL

mybatis中注解与xml配置的对应关系和对比分析

2021/08/04 Java/Android

python可视化之颜色映射详解

2021/09/15 Python