Python常用数据结构——集合

简介: Python常用数据结构——集合

集合
什么是集合
集合(Set)是 Python 中一种无序且元素唯一的数据结构。与列表和元组不同,集合中的元素没有顺序,并且每个元素在集合中只能出现一次。集合主要用于存储一组不重复的元素,常用于去除重复项或执行集合操作,如并集、交集、差集等。

在集合中,元素是无序排列的,这意味着你不能通过索引访问集合中的元素,因为集合没有固定的顺序。另外,集合中的元素必须是不可变的类型,例如数字、字符串、元组等。集合本身是可变的,可以动态添加或删除元素。

集合在 Python 中使用大括号 {} 或者 set() 函数来创建。如果要创建一个空集合,必须使用 set() 而不是 {},因为 {} 创建的是空字典。例如:

# 创建一个集合
student = {
   'Tom', 'Jim', 'Mary', 'Tom', 'Jack', 'Rose', 1, 2}
a = set('who what how when')

# 创建一个空集合
b = set()

需要注意的是,前面创建的集合都是可变集合。若要创建不可变集合,则要使用frozenset()函数来创建,具体代码如下:

numset = frozenset([1,2,3,4,5,6])

集合的两个基本功能
集合的两个基本功能分别是去重和成员测试。

去重是指把一个还有重复元素的列表或元组等数据类型转变成集合,其中的重复元素只出现一次。

成员测试,即判断元素是否在集合内。

代码如下:

# 定义一个集合
stus = {
   '张平', '李亮', '张可', '赵杰', '李亮', '赵杰', 10, 52, 10,52,'张可', '周涛'}
print('输出集合,重复的元素被自动去掉:', stus)

# 成员测试
if ('张可' in stus):
    print('\n张可在集合中, 所以张可是一名学术!')
else:
    print('\n张可不在集合中, 所以张可不是一名学术!')

if ('李杰' in stus):
    print('\n李杰在集合中,所以李杰是一名学生!')
else:
    print('\n李杰不在集合中,所以李杰不是一名学生!')

运行结果如下图:

image.png

集合的运算符
集合的运算符及意义
image.png
image.png
在上面的表格中,“数学符号”列显示了常见的数学符号,而“Python符号”列展示了相应的 Python 符号,而“说明”列则解释了每种集合运算符的含义。这些运算符可用于执行各种集合操作,如并集、交集、差集等。

示例代码如下:

a = set('I like Python!')
b = set('I love Java too!')

print('a 集合中的元素:',a, '\n')
print('b 集合中的元素:',b, '\n')
print('集合的差、并、交集运算结果:\n')
print('a和b的差集:', a - b, '\n')
print('a和b的并集:', a | b, '\n')
print('a和b的交集:', a & b, '\n')
print('集合的其他运算结果:\n')
print('a和b中不同时存在的元素:', a ^ b, '\n')
print('a和b的真子集:', a < b)
print('a和b的子集:', a <= b)
print('a和b的真超集:', a > b)
print('a和b的超集:‘', a >= b)
print('a和b的相等:', a == b)
print('a和b的不相等:', a != b)
print('集合的成员测试运算结果:\n')
print('a属于b:',a in b)
print('a不属于b:',a not in b)

运行结果如下:

a 集合中的元素: {
   't', 'n', 'l', 'e', 'P', 'o', 'i', ' ', 'y', 'k', 'I', '!', 'h'} 

b 集合中的元素: {
   't', 'l', 'o', 'e', 'a', ' ', 'J', 'I', '!', 'v'} 

集合的差、并、交集运算结果:

a和b的差集: {
   'n', 'P', 'i', 'y', 'k', 'h'} 

a和b的并集: {
   't', 'e', 'o', ' ', 'J', 'v', 'k', 'n', 'l', 'P', 'i', 'y', 'I', '!', 'a', 'h'} 

a和b的交集: {
   't', 'l', 'e', 'o', ' ', 'I', '!'} 

集合的其他运算结果:

a和b中不同时存在的元素: {
   'n', 'P', 'a', 'i', 'J', 'y', 'k', 'v', 'h'} 

a和b的真子集: False
a和b的子集: False
a和b的真超集: False
a和b的超集:‘ False
a和b的相等: False
a和b的不相等: True
集合的成员测试运算结果:

a属于b: False
a不属于b: True

示例:利用集合实现无重复的随机数排序

import random
mynum = input('请输入要排序的数字个数:')
mylist1 = []
for i in range(int(mynum)):
    num = random.randint(100, 1000)
    mylist1.append(num)
    mylist1.sort()
    print('输入的数字排序:',  mylist1)

myset1 = set(mylist1)
print('\n\n无重复数字:', myset1)
print('\n升序排列无重复数字:', sorted(myset1))
print('\n降序排列无重复数字:', sorted(mylist1, reverse=True))

运行结果如下:

请输入要排序的数字个数:20
输入的数字排序: [638]
输入的数字排序: [556, 638]
输入的数字排序: [446, 556, 638]
输入的数字排序: [446, 556, 638, 673]
输入的数字排序: [446, 556, 638, 673, 705]
输入的数字排序: [446, 556, 638, 673, 705, 721]
输入的数字排序: [293, 446, 556, 638, 673, 705, 721]
输入的数字排序: [293, 446, 482, 556, 638, 673, 705, 721]
输入的数字排序: [163, 293, 446, 482, 556, 638, 673, 705, 721]
输入的数字排序: [163, 293, 446, 482, 556, 638, 673, 697, 705, 721]
输入的数字排序: [163, 293, 446, 482, 556, 638, 673, 697, 705, 708, 721]
输入的数字排序: [163, 293, 446, 482, 556, 638, 673, 697, 705, 708, 721, 934]
输入的数字排序: [163, 293, 377, 446, 482, 556, 638, 673, 697, 705, 708, 721, 934]
输入的数字排序: [163, 293, 377, 446, 482, 556, 638, 673, 697, 705, 708, 721, 836, 934]
输入的数字排序: [163, 293, 377, 446, 482, 556, 638, 673, 697, 705, 708, 721, 836, 917, 934]
输入的数字排序: [163, 293, 349, 377, 446, 482, 556, 638, 673, 697, 705, 708, 721, 836, 917, 934]
输入的数字排序: [163, 293, 349, 377, 446, 482, 556, 638, 673, 697, 705, 708, 721, 800, 836, 917, 934]
输入的数字排序: [163, 293, 349, 377, 446, 482, 556, 638, 673, 697, 705, 708, 721, 800, 808, 836, 917, 934]
输入的数字排序: [163, 293, 349, 377, 446, 482, 526, 556, 638, 673, 697, 705, 708, 721, 800, 808, 836, 917, 934]
输入的数字排序: [163, 293, 349, 377, 430, 446, 482, 526, 556, 638, 673, 697, 705, 708, 721, 800, 808, 836, 917, 934]


无重复数字: {
   526, 917, 800, 673, 163, 293, 934, 808, 556, 430, 697, 446, 705, 708, 836, 721, 349, 482, 377, 638}

升序排列无重复数字: [163, 293, 349, 377, 430, 446, 482, 526, 556, 638, 673, 697, 705, 708, 721, 800, 808, 836, 917, 934]

降序排列无重复数字: [934, 917, 836, 808, 800, 721, 708, 705, 697, 673, 638, 556, 526, 482, 446, 430, 377, 349, 293, 163]

集合是一个非常有用的数据结构,特别适合处理需要保持唯一性的元素的情况。通过使用集合运算,可以方便地进行交集、并集、差集等操作。

相关文章
|
11月前
|
Java 数据挖掘 数据处理
(Pandas)Python做数据处理必选框架之一!(一):介绍Pandas中的两个数据结构;刨析Series:如何访问数据;数据去重、取众数、总和、标准差、方差、平均值等;判断缺失值、获取索引...
Pandas 是一个开源的数据分析和数据处理库,它是基于 Python 编程语言的。 Pandas 提供了易于使用的数据结构和数据分析工具,特别适用于处理结构化数据,如表格型数据(类似于Excel表格)。 Pandas 是数据科学和分析领域中常用的工具之一,它使得用户能够轻松地从各种数据源中导入数据,并对数据进行高效的操作和分析。 Pandas 主要引入了两种新的数据结构:Series 和 DataFrame。
816 0
|
存储 JSON 算法
Python集合:高效处理无序唯一数据的利器
Python集合是一种高效的数据结构,具备自动去重、快速成员检测和无序性等特点,适用于数据去重、集合运算和性能优化等场景。本文通过实例详解其用法与技巧。
357 0
|
存储 索引 Python
python 集合的所有基础知识
python 集合的所有基础知识
1240 0
|
11月前
|
存储 Java 索引
(Python基础)新时代语言!一起学习Python吧!(二):字符编码由来;Python字符串、字符串格式化;list集合和tuple元组区别
字符编码 我们要清楚,计算机最开始的表达都是由二进制而来 我们要想通过二进制来表示我们熟知的字符看看以下的变化 例如: 1 的二进制编码为 0000 0001 我们通过A这个字符,让其在计算机内部存储(现如今,A 字符在地址通常表示为65) 现在拿A举例: 在计算机内部 A字符,它本身表示为 65这个数,在计算机底层会转为二进制码 也意味着A字符在底层表示为 1000001 通过这样的字符表示进行转换,逐步发展为拥有127个字符的编码存储到计算机中,这个编码表也被称为ASCII编码。 但随时代变迁,ASCII编码逐渐暴露短板,全球有上百种语言,光是ASCII编码并不能够满足需求
429 4
|
12月前
|
机器学习/深度学习 数据采集 并行计算
多步预测系列 | LSTM、CNN、Transformer、TCN、串行、并行模型集合研究(Python代码实现)
多步预测系列 | LSTM、CNN、Transformer、TCN、串行、并行模型集合研究(Python代码实现)
1099 2
|
存储 开发者 索引
Python 中常见的数据结构
这些数据结构各有特点和适用场景,在不同的编程任务中发挥着重要作用。开发者需要根据具体需求选择合适的数据结构,以提高程序的效率和性能
684 156
|
存储 算法 搜索推荐
Python 中数据结构和算法的关系
数据结构是算法的载体,算法是对数据结构的操作和运用。它们共同构成了计算机程序的核心,对于提高程序的质量和性能具有至关重要的作用
625 153
|
存储 开发者 Python
Python 中的数据结构与其他编程语言数据结构的区别
不同编程语言都有其设计理念和应用场景,开发者需要根据具体需求和语言特点来选择合适的数据结构
766 151
|
存储 安全 Java
Java 集合面试题从数据结构到 HashMap 源码剖析详解及长尾考点梳理
本文深入解析Java集合框架,涵盖基础概念、常见集合类型及HashMap的底层数据结构与源码实现。从Collection、Map到Iterator接口,逐一剖析其特性与应用场景。重点解读HashMap在JDK1.7与1.8中的数据结构演变,包括数组+链表+红黑树优化,以及put方法和扩容机制的实现细节。结合订单管理与用户权限管理等实际案例,展示集合框架的应用价值,助你全面掌握相关知识,轻松应对面试与开发需求。
684 3

热门文章

最新文章

推荐镜像

更多