《笔记》Python itertools的groupby分组数据处理

今天遇到这么一个需求，需要将这样的数据进行分组处理：

[(, ), (, ), (, ), (, ), (, ), (, )]

处理之后我可能需要得到这样的结果：

[(, (, 4)), (, (, 6)), (, (, )), (, (, ))]

找了一些办法，最后想到了以前用过的在itertools里面的包groupby方法，因为比较少使用所以总是忘。它可以轻松的实现分组功能，由于是itertools包里面的，所以它的返回是一个迭代器。这一点要注意下面我们写代码来跑一下。

from itertools import groupby

from operator import itemgetter

x = [(1, 2), (2, 3), (1, 4), (5, 5), (3, 4), (2, 6)]

soooo = sorted(x, key=itemgetter(0))

p = groupby(soooo, key=itemgetter(0))

for i in p:

    print i[0], [_[1] for _ in i[1]]

output:

1 [2, 4]

2 [3, 6]

3 [4]

5 [5]

你可以使用itemgetter也可以直接顺手使用lamda表达式看你自己。

其实笨点的方法，用default dict似乎也可以实现。还是先然后把没组tuple的第一个元素做key 往后追加，得到一个字典。

之后再用字典.keys()方法获得去重的键，用values的方法获得数组。这种方法似乎还不需要排序，美滋滋。groupby使用之前要排序，否则无法达到效果。

Reference:

https://stackoverflow.com/questions/3749512/python-group-by Python group by

《笔记》Python itertools的groupby分组数据处理的更多相关文章

Python中itertools.groupby分组的使用
Python中itertools.groupby分组的使用有时候我们需要给一个列表按照某个属性分组,可以借助groupby来实现. 比如:一下列表我想以严重程度给它分组,并求出每组的元素个数. fr ...
Python中的字典分组函数（groupby,itertools）
from operator import itemgetter # itemgetter用来去dict中的key,省去了使用lambda函数 from itertools import groupby ...
python笔记之itertools模块
python笔记之itertools模块 itertools模块包含创建有效迭代器的函数,可以用各种方式对数据进行循环操作,此模块中的所有函数返回的迭代器都可以与for循环语句以及其他包含迭代器(如生 ...
Python标准库笔记(10) — itertools模块
itertools 用于更高效地创建迭代器的函数工具. itertools 提供的功能受Clojure,Haskell,APL和SML等函数式编程语言的类似功能的启发.它们的目的是快速有效地使用内存, ...
itertools.groupby()分组字典列表
## itertools.groupby()分组字典列表数据 from operator import itemgetter from itertools import groupby student ...
Python itertools模块详解
这货很强大, 必须掌握文档链接 http://docs.python.org/2/library/itertools.html pymotw 链接 http://pymotw.com/2/iter ...
Python 数据分析（二本实验将学习利用 Python 数据聚合与分组运算，时间序列，金融与经济数据应用等相关知识
Python 数据分析(二) 本实验将学习利用 Python 数据聚合与分组运算,时间序列,金融与经济数据应用等相关知识第1节 groupby 技术第2节数据聚合第3节分组级运算和转换第4 ...
pandas获取groupby分组里最大值所在的行,获取第一个等操作
pandas获取groupby分组里最大值所在的行 10/May 2016 python pandas pandas获取groupby分组里最大值所在的行如下面这个DataFrame,按照Mt分组, ...
python itertools 用法
1.介绍itertools 是python的迭代器模块,itertools提供的工具相当高效且节省内存.使用这些工具,你将能够创建自己定制的迭代器用于高效率的循环.- 无限迭代器 itertools包 ...

随机推荐

[tool] Visual Studio Code python配置
语言设置安装中文插件即可成为中文选择一个Python解释器 Python是一种解释型语言,为了运行Python代码并获取Python IntelliSense,您必须告诉VS Code使用哪个解释 ...
P2819 图的m着色问题（DFS）
思路:最开始的回溯顺序是正常的图遍历的回溯顺序,其实也没有错.但是,因为怎么调都不对,看了题解.下面,请结合题解思路和代码一起感受一下回溯顺序的改变,算法的改变和代码在哪里实现了这种顺序. 回溯顺序: ...
iterable与iterator
1.迭代器的感性认识对于Collection类下的集合如各种List各种Set,用于实现这些集合的数据结构各不相同,比如数组实现的ArrayList.链表实现的LinkedList,当客户端知道要使 ...
javascript中数组化的一般见解
javascript中数组化的一般见解,数组化浏览器中存在许多类数组对象,往往对类数组操作比较麻烦,没有数组那些非常方便的方法,在这种情况下,就有了数组化方法. 数组化的一般方法 1.第一种也是我们最 ...
Spring Security（二十五）：7. Sample Applications
There are several sample web applications that are available with the project. To avoid an overly la ...
Edusoho之LAMP环境搭建
主要参考官方文档Ubuntu16.04+Apache+PHP+MySQL+EduSoho 安装教程LAMP环境按照如下搭建是没有问题的,本地虚拟机试验是完全没有问题的. 1.更新 sudo apt-g ...
C# GDI+双缓冲技术
我想有很多搞图形方面的朋友都会用到双缓冲技术的时候,而且有的时候她的确是个头疼的问题.最近我也要用双缓冲技术,程序怎么调试都不合适,当要对图形进行移动时,总是会出现闪烁抖动.在网上找了些资料,说得都不 ...
C# — 创建Windows服务
以前从来没有接触过C#,对Windows服务也完全不了解,今天通过使用VS2017创建了一个Windows服务,并进行了安装和卸载,目前也是一知半解的地步,简单的做个笔记记录一下,也算是复习了吧. 第 ...
如何写出没有BUG的代码
1947年9月9日,美国海军准将 Grace Hopper 在哈佛学院计算机实验室里使用 Mark II 和 Mark III 计算机进行研究工作.她的团队跟踪到 Mark II 上的一个错误,操作人 ...
1. FPGA内部的逻辑资源
CLB(包括LUT.加法器.寄存器.MUX(多路选择器)) 时钟网络资源(全局时钟网络,区域时钟网络,IO时钟网络),理解时钟网络的本质和意义时钟处理单元(PLL,DCM),理解时钟网络资源和时钟处 ...

《笔记》Python itertools的groupby分组数据处理

《笔记》Python itertools的groupby分组数据处理的更多相关文章

随机推荐

热门专题