Python数据类型-集合(set)
1、创建集合
集合的创建不同于前两种数据结构。
集合通过set(iterable)方法创建,参数iterable为可迭代对象。
示例代码:
s1 = set('好好学习天天想上') # 将字符串分解为单个字符,作为集合的元素创建集合
s2 = set(('好好', '学习', '天天', '想上')) # 将元组分解为单个元素,作为集合元素创建集合
s3 = set(['好好', '学习', '天天', '想上']) # 将列表分解为单个元素,作为集合元素创建集合
print (s1) # 显示输出结果为:{'好', '习', '上', '天', '想', '学'}
print (s2) # 显示输出结果为:{'好好', '想上', '学习', '天天'}
print (s3) # 显示输出结果为:{'好好', '想上', '学习', '天天'}
通过上方示例,大家能够看出:
- 集合可以通过可迭代对象(字符串、元组、列表等)进行创建;
- 集合中的元素不可重复;
- 集合中的元素无序排列。
2、添加元素
集合添加元素的方法有两种。
添加单个元素:使用add(element)函数,参数element为集合允许添加的元素(例如数字、字符串、元组等)。
添加多个元素:使用update(iterable)函数,参数iterable为可迭代对象。
示例代码:
# 创建集合
s1 = set('123')
s2 = set('123')
s3 = set('abc') # 添加单个元素
s1.add('4') # 添加多个元素
s2.update(['4','5','6']) # 添加列表到集合,列表元素会被分解为单个元素后添加到集合
s3.update('de') # 添加字符串到集合,字符串会被分解为单个元素后添加到集合 # 显示输出
print (s1) # 显示输出结果为:{'4', '3', '1', '2'}
print (s2) # 显示输出结果为:{'4', '2', '6', '5', '3', '1'}
print (s3) # 显示输出结果为:{'c', 'b', 'd', 'e', 'a'} #注意:因为集合元素是无序的,大家在测试以上代码时,显示输出的结果与上方结果,可能在顺序上不一致。
3、删除元素
集合删除元素的方法有两种。
第一种:使用remove(element)方法删除指定元素,参数element为需要删除的元素。
第二种:使用discard(element)方法删除指定元素,参数element为需要删除的元素。
示例代码:
# 创建集合
s1 = set(['Python','Java','C','C++','C#'])
s2 = set(['Python','Java','C','C++','C#']) # 删除元素
s1.remove('C++')
s2.discard('C++') # 显示输出
print (s1) # 显示输出结果为:{'C', 'Python', 'Java', 'C#'}
print (s2) # 显示输出结果为:{'C', 'Python', 'Java', 'C#'}
从上方示例中,大家能够看到remove()和discard()的作用是一样的。
不过,这两个方法是有区别的。
当集合中不存在这两个方法参数中填入的元素时,remove()方法会抛出异常,而discard()方法则没有任何影响。
4、取出元素
集合支持pop()方法取出元素。
示例代码:
# 创建集合
s = set(['Python','Java','C','C++','C#']) # 显示输出
print (s) # 显示输出结果为:{'Python', 'C#', 'C++', 'Java', 'C'}
print (s.pop()) # 取出集合元素,显示输出结果为:Python
print (s) # 显示输出结果为:{'C#', 'C++', 'Java', 'C'}
5、清空集合
集合支持clear()方法进行清空。
示例代码:
# 创建集合
s = set(['Python','Java','C','C++','C#']) # 清空集合
s.clear() # 显示输出
print (s) # 显示输出结果为:set()
6、交集/并集/补集/差集
首先我们来看张图,理解交集、并集、补集、差集的概念。

假设有集合A{1,2,3}和B{3,4,5}。
交集:A和B中相同部分的内容,{3}。
并集:A和B去重后的全部内容,{1,2,3,4,5}。
补集:A去除与B相交部分后的内容,{1,2}。
差集:A和B不相交部分的全部内容,{1,2,4,5}。
示例代码:
# 创建集合
s1 = set('Python')
s2 = set('PyCharm') # 交集操作:获取两个集合中共有元素。
print (s1 & s2) # 显示输出结果为:{'y', 'P', 'h'}
print (s1.intersection(s2)) # 显示输出结果为:{'y', 'P', 'h'} # 并集操作:获取两个集合去除重复元素后的全部元素。
print (s1 | s2) # 显示输出结果为:{'y', 'a', 'C', 'o', 'P', 'n', 't', 'm', 'r', 'h'}
print (s1.union(s2)) # 显示输出结果为:{'y', 'a', 'C', 'o', 'P', 'n', 't', 'm', 'r', 'h'} # 补集操作:获取当前集合去除与另一集合交集元素后的全部元素。
print (s1 - s2) # 显示输出结果为:{'o', 't', 'n'}
print (s1.difference(s2)) # 显示输出结果为:{'o', 't', 'n'}
print (s2 - s1) # 显示输出结果为:{'m', 'a', 'r', 'C'}
print (s2.difference(s1)) # 显示输出结果为:{'m', 'a', 'r', 'C'} # 差集操作:获取两个集合去除交集元素后的全部元素。
print (s1 ^ s2) # 显示输出结果为:{'o', 't', 'm', 'a', 'r', 'n', 'C'}
print (s1.symmetric_difference(s2)) # 显示输出结果为:{'o', 't', 'm', 'a', 'r', 'n', 'C'}
以上操作中,对集合本身内容并无影响,大家可以在执行以上代码后,继续显示输出s1和s2的内容,能够看到没有任何变化。
接下来,我们再来看几个方法,这些方法会改变集合内容。
第一种:difference_update(set) 函数,能够将当前集合和指定集合进行补集运算,并将当前集合内容更新为运算结果。
示例代码:
s1=set('1234')
s2=set('456')
s1.difference(s2) # 该操作对s1内容无影响
print (s1) # s1无变化,显示输出结果为:{'3', '4', '2', '1'}
s1.difference_update(s2) # 更新集合s1的内容为s1-s2后的结果
print (s1) # s1内容被更新,显示输出结果为:{'3', '2', '1'}
第二种:intersection_update(set) 函数,能够将当前集合和指定集合进行交集运算,并将当前集合内容更新为运算结果。
示例代码:
s1=set('1234')
s2=set('456')
s1.intersection_update(s2) # 更新集合s1的内容为s1 & s2后的结果
print (s1) # s1内容被更新,显示输出结果为:{'4'}
第三种:symmetric_difference_update(set) 函数,能够将当前集合和指定集合进行差集运算,并将当前集合内容更新为运算结果。
示例代码:
s1 = set('1234')
s2 = set('456')
s1.symmetric_difference_update(s2) # 更新集合s1的内容为s1 ^ s2后的结果
print(s1) # s1内容被更新,显示输出结果为:{'6', '3', '2', '5', '1'}
7、成员关系
Python中提供了一些方法,让我们能够判断一个集合中是否包含某一元素;
也可以判断一个集合是否另一个集合的子集或超集。
还可以判断一个集合与另一个集合是否没有交集。

在之前我们接触过“in”这操作符,可以用来判断操作符前方的值是否被后方的序列包含(成员关系)。
另外,我们还可以使用“not in”,判断操作符前方的值是否未被后方的序列包含(非成员关系)。
在集合中,我们同样可以使用这两个操作符。
另外,我们还可以通过以下方法,判断一个集合是否另外一个集合的子集或超集以及没有交集。
isdisjoint(set):可以判断集合是否与指定集合不存在交集,参数set为集合;如果成立返回结果为True,否则为False。
issubset(set):可以判断集合是否指定集合的子集,参数set为集合;如果成立返回结果为True,否则为False。
issuperset(set):可以判断集合是否指定集合的超集,参数set为集合;如果成立返回结果为True,否则为False。
示例代码:
s1 = set('好好学习')
s2 = set('天天想上')
s3 = set('好好学习天天想上')
print ('好' in s1) # 显示输出结果为:True
print ('好' not in s2) # 显示输出结果为:True
print (s1.isdisjoint(s2)) # 显示输出结果为:True
print (s1.issubset(s3)) # 显示输出结果为:True
print (s3.issuperset(s1)) # 显示输出结果为:True
8、复制集合
使用copy()方法能够对集合进行复制。
大家通过下方代码即可理解复制的用途。
示例代码:
a = set('小楼一夜听春语') # 创建集合存入变量a
b = a # 创建变量b引用变量a的集合
c = a.copy() # 创建变量c复制变量a的值
print (a) # 显示输出结果为:{'春', '夜', '楼', '听', '语', '小', '一'}
print (b) # 显示输出结果为:{'春', '夜', '楼', '听', '语', '小', '一'}
print (c) # 显示输出结果为:{'春', '夜', '楼', '听', '语', '小', '一'}
a.remove('一') # 删除变量a中集合的一个元素
print (a) # 变量a发生改变,显示输出结果为:{'春', '夜', '楼', '听', '语', '小'}
print (b) # 变量b因为引用变量a,同样发生改变,显示输出结果为:{'春', '夜', '楼', '听', '语', '小'}
print (c) # 变量c没有改变,显示输出结果为:{'春', '夜', '楼', '听', '语', '小', '一'}
如果还不能够理解,我们可以看下面这张图。

代码中,b = a实际上是将b指向了a的内容,所以当a的内容发生变化时,b同步发生了变化。
而c = a.copy()则是将a的内容真正进行了复制,不再受a的变化影响。
9、其他
集合也支持len()方法进行元素数量的获取,也支持max()方法和min方法获取集合中的最大元素与最小元素,在此不再赘述
Python数据类型-集合(set)的更多相关文章
- Python数据类型--集合(set)
Python的集合是无序.可迭代的容器对象,所有元素放在一对大括号中{},元素之间使用逗号隔开,同一集合内的元素具有唯一性,不允许重复. 集合中只能包含数字.字符串.元组等不可变类型的数据,不能包含列 ...
- python初步学习-python数据类型-集合(set)
集合 在已经学过的数据类型中: 能够索引的,如list/str,其中的元素可以重复 可变的,如list/dict,即其中的元素/键值对可以原地修改 不可变的,如str/int,即不能进行原地修改 无索 ...
- 10 Python 数据类型—集合
在Python set是基本数据类型的一种集合类型,它有可变集合(set())和不可变集合(frozenset)两种.创建集合set.集合set添加.集合删除.交集.并集.差集的操作都是非常实用的方法 ...
- Python 数据类型--集合(set)
一.集合(set) 集合也是一种数据类型,一个类似列表的,无序的,不重复的.它主要有两大作用 1.把一个列表变为集合,就自动去重了,不需要写额外的代码 2.关系测试,测试两组数据之间的交际.差集.并集 ...
- python数据类型(集合)
一.集合概念 集合是一个数学概念:由一个或多个确定的元素所构成的整体叫做集合. 集合中的元素三个特征: 确定性(元素必须可hash) 互异性(去重)——将一个列表变为集合,就自动去重了 无序性(集合中 ...
- python 数据类型 --- 集合
1. 注意列表和集合的区别 set 列表表现形式: list_1 = [1,3,4]; 集合表现形式:set_1= set() list_1 = [1,2,3,4,23,4,2] print(lis ...
- python基础3 ---python数据类型二
ython基础 一.python数据类型 ------列表(list) 1.定义:[]内以逗号分隔,按照索引,存放各种数据类型,每个位置代表一个元素 特性:可存放多个不同类型的值:可修改指定索 ...
- python数据类型之元组、字典、集合
python数据类型元组.字典.集合 元组 python的元组与列表类似,不同的是元组是不可变的数据类型.元组使用小括号,列表使用方括号.当元组里只有一个元素是必须要加逗号: >>> ...
- Python数据类型的内置函数之tuple(元组),dict(字典),set(集合)
Python数据类型内置函数 - str(字符串) - list(列表) - tuple(元组) - dict(字典) - set(收集) tuple(元组)的操作 - (count)统计元组中元素出 ...
随机推荐
- ios 虚拟机中文件下载路径
每个人mac上的路径会有不同,你可以打印出你文件下载存放的路径,然后拷贝一下,再单击桌面空白处,最上面的导航栏上有个“前往”,然后找到“前往文件夹”,粘贴一下,就可以找到了.
- /etc/rc.d/里文件的作用
rc.sysinit指的是系统启动不管进哪个运行级别必须做的初始化工作, rcn.d目录指的是系统进对应n的运行级别时候系统必须做的工作,目录下S打头的服务指进此运行级别时候启动的服务,而K打头的指离 ...
- 分治法:快速排序求第K极值
标题其实就是nth_element函数的底层实现 nth_element(first, nth, last, compare) 求[first, last]这个区间中第n大小的元素 如果参数加入了co ...
- linux的MySQL设为开机启动
linux开启启动的程序一般放在/etc/rc.d/init.d/里面,/etc/init.d/是其软连接 mysql设为linux服务cp /usr/local/mysql5/share/mysql ...
- 重构改善既有代码设计--重构手法08:Replace Method with Method Object (以函数对象取代函数)
你有一个大型函数,其中对局部变量的使用,使你无法釆用 Extract Method. 将这个函数放进一个单独对象中,如此一来局部变量就成了对象内的值域(field) 然后你可以在同一个对象中将这个大型 ...
- Java学习遇到的问题
一. Java中泛型如何比较大小,继承Comparable类,然后实现其唯一的方法compareTo(): public class GenericClass<E extends Compara ...
- Jdbc练习
import java.sql.Connection; import java.sql.DriverManager; import java.sql.PreparedStatement; import ...
- JSON 为王,为什么 XML 会慢慢淡出人们的视野?
目前全球信息基础设施的特点是,拥有大量的数据交换格式.这一点也不奇怪.互联网几乎已经老了,而“物联网”及“大数据”正从概念走进现实.但我仍然相信,在这一领域还有一股较强的历史趋势,推动 JSON 数据 ...
- 【BZOJ】1707: [Usaco2007 Nov]tanning分配防晒霜
[算法]贪心扫描线(+堆) [题意]给定n头牛有区间[a,b],m个防晒霜值为ai,每个可以使用bi次,每次可以使包含它的区间涂到防晒霜,问最多被涂牛数. [题解] 参考:[bzoj1707]: [U ...
- js写弹窗
1.先来看弹窗的模样 点击“弹出窗口”后会弹出下面窗口 2.下面是实现弹出窗口的代码,其中引入的jquery一般自己有,没有的话可以从网上下载.tanchuang.js和tanchuang.css写在 ...