当前位置:首页 > 文章列表 > 文章 > linux > Python 中 set 是什么?为何要是用它?

Python 中 set 是什么?为何要是用它?

2025-01-26 17:09:50 0浏览 收藏

文章不知道大家是否熟悉?今天我将给大家介绍《Python 中 set 是什么?为何要是用它?》,这篇文章主要会讲到等等知识点,如果你在看完本篇文章后,有更好的建议或者发现哪里有问题,希望大家都能积极评论指出,谢谢!希望我们能一起加油进步!

Python 中 set 是什么?为何要是用它?

Python 提供多种内置数据结构用于组织数据,包括列表、字典、元组和集合。

根据 Python 3 文档,集合是无序的、不包含重复元素的集合。其主要用途包括成员测试去除重复项。集合还支持集合运算,如并集交集差集对称差集

本文将通过示例阐述以上定义中的每个特性,并讲解集合的创建方法。

**集合的初始化**
创建集合有两种方法:一是将元素列表传递给内置函数 `set()`,二是使用花括号 `{}`。

使用 set() 函数初始化集合:

>>> s1 = set([1, 2, 3])
>>> s1
{1, 2, 3}
>>> type(s1)

使用 {} 初始化集合:

>>> s2 = {3, 4, 5}
>>> s2
{3, 4, 5}
>>> type(s2)

两种方法均有效。但如果需要创建空集合呢?

>>> s = {}
>>> type(s)

使用空花括号将创建一个字典,而非集合。

为简便起见,本文示例使用整数集合,但集合可包含所有 Python 支持的可哈希hashable[1]数据类型,例如整数、字符串和元组,但不包括列表或字典等可变类型。

>>> s = {1, 'coffee', [4, 'python']}
Traceback (most recent call last):
  File "", line 1, in 
TypeError: unhashable type: 'list'

了解了集合的创建方法及其可包含的元素类型后,我们来探讨一下为什么应该将集合纳入你的编程工具箱。

**为什么需要使用集合**
编程中,解决问题的方法不止一种。有些方法效率低下,而另一些则清晰、简洁、易于维护,或者更“Pythonicpythonic[2]”。

根据 Python Hitchhiker's Guide[3]:

当经验丰富的 Python 开发者(PythonistaPythonista)遇到不够“Pythonicpythonic”的代码时,通常认为这些代码不符合通用指南,表达意图的方式不够理想(可读性差)。

让我们看看集合如何提升代码可读性并提高程序执行效率。

**集合元素的无序性**
集合元素无法通过索引访问:
>>> s = {1, 2, 3}
>>> s[0]
Traceback (most recent call last):
  File "", line 1, in 
TypeError: 'set' object does not support indexing

也无法使用切片修改:

>>> s[0:2]
Traceback (most recent call last):
  File "", line 1, in 
TypeError: 'set' object is not subscriptable

但如果需要去除重复项或进行集合运算(如并集),则应该使用集合。

迭代时,集合的效率优于列表。原因涉及集合的内部实现细节,感兴趣的读者可以参考以下链接:

  • 时间复杂度[4]
  • set() 的实现[5]
  • Python 集合 vs 列表[6]
  • 列表中使用集合的优缺点[7]
**集合不包含重复项**
过去,我经常使用 `for` 循环和 `if` 语句来检查并去除列表中的重复元素,代码如下:
>>> my_list = [1, 2, 3, 2, 3, 4]
>>> no_duplicate_list = []
>>> for item in my_list:
...     if item not in no_duplicate_list:
...             no_duplicate_list.append(item)
...
>>> no_duplicate_list
[1, 2, 3, 4]

或者使用列表推导式:

>>> my_list = [1, 2, 3, 2, 3, 4]
>>> no_duplicate_list = []
>>> [no_duplicate_list.append(item) for item in my_list if item not in no_duplicate_list]
[None, None, None, None]
>>> no_duplicate_list
[1, 2, 3, 4]

现在,我们可以使用集合:

>>> my_list = [1, 2, 3, 2, 3, 4]
>>> no_duplicate_list = list(set(my_list))
>>> no_duplicate_list
[1, 2, 3, 4]

使用 timeit 模块比较列表和集合去除重复项的效率:

>>> from timeit import timeit
>>> def no_duplicates(list):
...     no_duplicate_list = []
...     [no_duplicate_list.append(item) for item in list if item not in no_duplicate_list]
...     return no_duplicate_list
...
>>> # 列表的执行时间:
>>> print(timeit('no_duplicates([1, 2, 3, 1, 7])', globals=globals(), number=1000))
0.0018683355819786227
>>> from timeit import timeit
>>> # 集合的执行时间:
>>> print(timeit('list(set([1, 2, 3, 1, 2, 3, 4]))', number=1000))
0.0010220493243764395
>>> # 更快更简洁

使用集合比列表推导式更简洁,效率更高。

注意:集合是无序的,转换为列表后元素顺序可能发生变化。

Python 之禅[8]:

优美胜于丑陋Beautiful is better than ugly.

明了胜于晦涩Explicit is better than implicit.

简洁胜于复杂Simple is better than complex.

扁平胜于嵌套Flat is better than nested.

集合正是如此。

**成员测试**
使用 `if` 语句检查元素是否存在于列表中,称为成员测试:
my_list = [1, 2, 3]
>>> if 2 in my_list:
...     print('Yes, this is a membership test!')
...
Yes, this is a membership test!

集合的成员测试效率更高:

>>> from timeit import timeit
>>> def in_test(iterable):
...     for i in range(1000):
...             if i in iterable:
...                     pass
...
>>> timeit('in_test(iterable)',
... setup="from __main__ import in_test; iterable = list(range(1000))",
... number=1000)
12.459663048726043
>>> from timeit import timeit
>>> def in_test(iterable):
...     for i in range(1000):
...             if i in iterable:
...                     pass
...
>>> timeit('in_test(iterable)',
... setup="from __main__ import in_test; iterable = set(range(1000))",
... number=1000)
.12354438152988223

注意:以上测试来自 StackOverflow[9]。

对于大型列表,将其转换为集合可以提高成员测试效率。

**如何使用集合**
了解了集合及其用途后,我们来快速浏览一下集合的修改和操作方法。
**添加元素**
根据需要添加的元素数量,选择 `add()` 或 `update()` 方法。

add() 用于添加单个元素:

>>> s = {1, 2, 3}
>>> s.add(4)
>>> s
{1, 2, 3, 4}

update() 用于添加多个元素:

>>> s = {1, 2, 3}
>>> s.update([2, 3, 4, 5, 6])
>>> s
{1, 2, 3, 4, 5, 6}

集合会自动去除重复元素。

**移除元素**
如果需要在删除不存在的元素时引发异常,使用 `remove()`;否则,使用 `discard()`:
>>> s = {1, 2, 3}
>>> s.remove(3)
>>> s
{1, 2}
>>> s.remove(3)
Traceback (most recent call last):
  File "", line 1, in 
KeyError: 3

discard() 不会引发异常:

>>> s = {1, 2, 3}
>>> s.discard(3)
>>> s
{1, 2}
>>> s.discard(3)
>>> # 无任何操作

pop() 用于随机移除一个元素:

>>> s = {1, 2, 3, 4, 5}
>>> s.pop()  # 移除一个任意元素
1
>>> s
{2, 3, 4, 5}

clear() 用于清空集合:

>>> s = {1, 2, 3, 4, 5}
>>> s.clear()  # 清空集合
>>> s
set()
**并集 `union()`**
`union()` 或 `|` 操作符创建包含所有元素的新集合:
>>> s1 = {1, 2, 3}
>>> s2 = {3, 4, 5}
>>> s1.union(s2)  # 或 's1 | s2'
{1, 2, 3, 4, 5}
**交集 `intersection()`**
`intersection()` 或 `&` 操作符返回集合的公共元素:
>>> s1 = {1, 2, 3}
>>> s2 = {2, 3, 4}
>>> s3 = {3, 4, 5}
>>> s1.intersection(s2, s3)  # 或 's1 & s2 & s3'
{3}
**差集 `difference()`**
`difference()` 或 `-` 操作符创建新集合,包含在 `s1` 中但在 `s2` 中不存在的元素:
>>> s1 = {1, 2, 3}
>>> s2 = {2, 3, 4}
>>> s1.difference(s2)  # 或 's1 - s2'
{1}
**对称差集 `symmetric_difference()`**
`symmetric_difference()` 或 `^` 操作符返回集合中不同的元素:
>>> s1 = {1, 2, 3}
>>> s2 = {2, 3, 4}
>>> s1.symmetric_difference(s2)  # 或 's1 ^ s2'
{1, 4}
**结论**
本文介绍了 Python 集合的概念、操作方法和应用场景。熟练掌握集合的使用可以编写更清晰、更高效的代码。

如有任何疑问,请随时提出。此外,Python 速查表[10]中也包含了集合的相关内容[11],方便查阅。

以上就是本文的全部内容了,是否有顺利帮助你解决问题?若是能给你带来学习上的帮助,请大家多多支持golang学习网!更多关于文章的相关知识,也可关注golang学习网公众号。

小米商城上线璀璨洋红OK手型版气门芯帽 售价39元小米商城上线璀璨洋红OK手型版气门芯帽 售价39元
上一篇
小米商城上线璀璨洋红OK手型版气门芯帽 售价39元
郭明錤预测苹果iPhone 17系列灵动岛尺寸几乎保持不变
下一篇
郭明錤预测苹果iPhone 17系列灵动岛尺寸几乎保持不变
查看更多
最新文章
查看更多
课程推荐
  • 前端进阶之JavaScript设计模式
    前端进阶之JavaScript设计模式
    设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
    543次学习
  • GO语言核心编程课程
    GO语言核心编程课程
    本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
    516次学习
  • 简单聊聊mysql8与网络通信
    简单聊聊mysql8与网络通信
    如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
    500次学习
  • JavaScript正则表达式基础与实战
    JavaScript正则表达式基础与实战
    在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
    487次学习
  • 从零制作响应式网站—Grid布局
    从零制作响应式网站—Grid布局
    本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
    485次学习
查看更多
AI推荐
  • ChatExcel酷表:告别Excel难题,北大团队AI助手助您轻松处理数据
    ChatExcel酷表
    ChatExcel酷表是由北京大学团队打造的Excel聊天机器人,用自然语言操控表格,简化数据处理,告别繁琐操作,提升工作效率!适用于学生、上班族及政府人员。
    5917次使用
  • Any绘本:开源免费AI绘本创作工具深度解析
    Any绘本
    探索Any绘本(anypicturebook.com/zh),一款开源免费的AI绘本创作工具,基于Google Gemini与Flux AI模型,让您轻松创作个性化绘本。适用于家庭、教育、创作等多种场景,零门槛,高自由度,技术透明,本地可控。
    6346次使用
  • 可赞AI:AI驱动办公可视化智能工具,一键高效生成文档图表脑图
    可赞AI
    可赞AI,AI驱动的办公可视化智能工具,助您轻松实现文本与可视化元素高效转化。无论是智能文档生成、多格式文本解析,还是一键生成专业图表、脑图、知识卡片,可赞AI都能让信息处理更清晰高效。覆盖数据汇报、会议纪要、内容营销等全场景,大幅提升办公效率,降低专业门槛,是您提升工作效率的得力助手。
    6156次使用
  • 星月写作:AI网文创作神器,助力爆款小说速成
    星月写作
    星月写作是国内首款聚焦中文网络小说创作的AI辅助工具,解决网文作者从构思到变现的全流程痛点。AI扫榜、专属模板、全链路适配,助力新人快速上手,资深作者效率倍增。
    8132次使用
  • MagicLight.ai:叙事驱动AI动画视频创作平台 | 高效生成专业级故事动画
    MagicLight
    MagicLight.ai是全球首款叙事驱动型AI动画视频创作平台,专注于解决从故事想法到完整动画的全流程痛点。它通过自研AI模型,保障角色、风格、场景高度一致性,让零动画经验者也能高效产出专业级叙事内容。广泛适用于独立创作者、动画工作室、教育机构及企业营销,助您轻松实现创意落地与商业化。
    6687次使用
微信登录更方便
  • 密码登录
  • 注册账号
登录即同意 用户协议隐私政策
返回登录
  • 重置密码