Python pathlib 批量整理文件实战:按扩展名归档和冲突重命名
下载目录、导出报表目录、截图目录,用久了以后很容易堆成一片:PDF、图片、压缩包、Excel、临时文件混在一起。手动整理不难,但重复做就很烦,而且容易误拖文件。
Python 的 pathlib 很适合写这类小工具。它把路径当成对象来处理,比拼字符串更清晰。本文用一个“按扩展名整理下载目录”的场景,演示如何扫描文件、创建目录、处理同名冲突、移动文件并记录日志。
摘要
本文会从混乱目录的整理问题讲起,用 pathlib.Path 获取文件列表,根据后缀映射到分类目录,再用安全重命名避免覆盖已有文件,最后把每次移动记录到日志中,方便回查。
适合人群
- 想用 Python 写本地文件整理脚本的初中级开发者。
- 经常处理下载目录、报表目录、截图目录的办公自动化用户。
- 已经掌握基础 Python 语法,希望熟悉
pathlib的读者。
目录
- 先明确整理规则
- 用 pathlib 扫描目录
- 按扩展名映射目标目录
- 处理同名文件冲突
- 移动文件并写入日志
- 常见坑和总结
一、先明确整理规则
脚本动文件之前,先把规则写清楚。比如下载目录里常见的文件可以这样分类:
.png、.webp、.gif放到images。.pdf、.docx、.xlsx放到documents。.zip、.tar、.gz放到archives。- 未知后缀放到
others。
如果不先定义规则,脚本很容易写成“看到什么处理什么”,后面维护起来会很乱。

二、用 pathlib 扫描目录
Path.iterdir() 可以列出目录下的直接子项。我们只处理文件,跳过目录。
from pathlib import Path
source_dir = Path.home() / "Downloads"
for item in source_dir.iterdir():
if item.is_file():
print(item.name, item.suffix.lower())
suffix 会返回文件后缀,例如 .pdf。这里统一转成小写,是为了让 .PNG 和 .png 使用同一套规则。
三、按扩展名映射目标目录
把分类规则写成字典,脚本会更容易改:
from pathlib import Path
CATEGORY_MAP = {
".png": "images",
".webp": "images",
".gif": "images",
".pdf": "documents",
".docx": "documents",
".xlsx": "documents",
".zip": "archives",
".tar": "archives",
".gz": "archives",
}
def target_folder(file_path: Path) -> str:
suffix = file_path.suffix.lower()
return CATEGORY_MAP.get(suffix, "others")
如果以后要新增 .csv、.pptx,只需要改字典,不需要改移动逻辑。
四、处理同名文件冲突
移动文件前必须处理同名冲突。比如 report.pdf 已经在目标目录里,新的 report.pdf 不能直接覆盖。
from pathlib import Path
def unique_path(target: Path) -> Path:
if not target.exists():
return target
stem = target.stem
suffix = target.suffix
parent = target.parent
index = 1
while True:
candidate = parent / f"{stem}-{index}{suffix}"
if not candidate.exists():
return candidate
index += 1
这段函数会把冲突文件改成 report-1.pdf、report-2.pdf 这样的形式,避免覆盖历史文件。

五、移动文件并写入日志
下面把扫描、分类、重命名和日志串起来:
from pathlib import Path
import shutil
from datetime import datetime
def organize_files(source_dir: Path) -> None:
log_path = source_dir / "organize.log"
with log_path.open("a", encoding="utf-8") as log:
for item in source_dir.iterdir():
if not item.is_file():
continue
if item.name == log_path.name:
continue
folder_name = target_folder(item)
target_dir = source_dir / folder_name
target_dir.mkdir(exist_ok=True)
target = unique_path(target_dir / item.name)
shutil.move(str(item), str(target))
now = datetime.now().strftime("%Y-%m-%d %H:%M:%S")
log.write(f"{now} | {item.name} -> {target.relative_to(source_dir)}\n")
if __name__ == "__main__":
organize_files(Path.home() / "Downloads")
日志大致会长这样:
2026-06-13 10:20:01 | report.pdf -> documents/report.pdf 2026-06-13 10:20:01 | report.pdf -> documents/report-1.pdf 2026-06-13 10:20:02 | demo.png -> images/demo.png
有了日志,后续发现移动结果不符合预期时,至少能快速知道每个文件去了哪里。
六、常见坑和总结
1. 先在测试目录跑
批量移动文件前,建议复制一小份样例目录测试规则,确认分类、重命名和日志都符合预期后,再对真实目录运行。
2. 不要处理脚本自己的日志文件
日志文件通常放在源目录里,如果不跳过它,脚本可能把日志移动到 others,后续记录就乱了。
3. 后缀不是文件类型的绝对保证
本文按后缀归类,适合普通整理场景。如果涉及安全校验,还需要结合文件头、MIME 或业务规则进一步判断。
4. 移动前保留可回查信息
批量整理不是一次性动作,日志和冲突重命名都很重要。它们能降低误覆盖和误移动带来的损失。
总结一下,pathlib 能让本地路径处理更清楚:扫描用 iterdir,后缀用 suffix,目录创建用 mkdir,路径拼接用 /。再加上冲突重命名和日志记录,一个实用的批量文件整理脚本就比较稳了。
Go JSON 配置解析实战:结构体标签、默认值和未知字段检查
- 上一篇
- Go JSON 配置解析实战:结构体标签、默认值和未知字段检查
- 下一篇
- Redis 热 Key 治理实战:发现访问倾斜、拆分缓存和本地兜底
-
- 文章 · python教程 | 5天前 | logging · Python教程 · 后端开发 · 日志排查 · Python logging 日志重复 propagate addHandler basicConfig
- Python logging 日志重复打印排查:为什么一条记录输出了两遍
- 324浏览 收藏
-
- 文章 · python教程 | 2星期前 | 默认值 · python · 数据建模 · dataclass · default_factory · field · Python 数据类 Field 可变默认值 dataclass default_factory
- Python dataclass 默认值完整工作流:从可变默认值到 default_factory
- 228浏览 收藏
-
- 前端进阶之JavaScript设计模式
- 设计模式是开发人员在软件开发过程中面临一般问题时的解决方案,代表了最佳的实践。本课程的主打内容包括JS常见设计模式以及具体应用场景,打造一站式知识长龙服务,适合有JS基础的同学学习。
- 543次学习
-
- GO语言核心编程课程
- 本课程采用真实案例,全面具体可落地,从理论到实践,一步一步将GO核心编程技术、编程思想、底层实现融会贯通,使学习者贴近时代脉搏,做IT互联网时代的弄潮儿。
- 516次学习
-
- 简单聊聊mysql8与网络通信
- 如有问题加微信:Le-studyg;在课程中,我们将首先介绍MySQL8的新特性,包括性能优化、安全增强、新数据类型等,帮助学生快速熟悉MySQL8的最新功能。接着,我们将深入解析MySQL的网络通信机制,包括协议、连接管理、数据传输等,让
- 500次学习
-
- JavaScript正则表达式基础与实战
- 在任何一门编程语言中,正则表达式,都是一项重要的知识,它提供了高效的字符串匹配与捕获机制,可以极大的简化程序设计。
- 487次学习
-
- 从零制作响应式网站—Grid布局
- 本系列教程将展示从零制作一个假想的网络科技公司官网,分为导航,轮播,关于我们,成功案例,服务流程,团队介绍,数据部分,公司动态,底部信息等内容区块。网站整体采用CSSGrid布局,支持响应式,有流畅过渡和展现动画。
- 485次学习
-
- ljg-skills
- ljg-skills 是李继刚开源的 AI 技能与提示词集合,面向大模型使用者整理了一批可复用的 prompt、角色设定和任务技能模板,适合用于学习提示词设计、搭建个人 AI 工作流和沉淀团队常用智能体能力。
- 3541次使用
-
- MELO音乐
- MELO音乐是一站式AI视频与音乐制作助手,对标suno, udio的高品质体验。提供伴奏生成、原创写词、无损导出、哼唱识曲、混音变声等全套音频与短视频编辑工具。无论是流行Kpop、电音说唱、民谣古风、摇滚儿歌还是商用轻音乐,MELO为你免费谱曲,轻松做同款!
- 3263次使用
-
- UniScribe
- UniScribe 是一款 AI 音视频转文字与内容整理工具,支持上传音频、视频文件或粘贴 YouTube 链接,自动生成转写文本、摘要、思维导图和关键问题,并支持多格式导出,适合会议记录、课程学习、访谈整理和内容创作复盘。
- 3237次使用
-
- 剧云
- 剧云是专业中文剧本创作平台,安全稳定运行十余年,集成AI编剧、剧本医生审核、人物小传、剧情关系图、大纲编写、多人协作、Word导入导出、版权管控功能,数据安全防护,轻松高效创作剧本。
- 3440次使用
-
- 万象有声
- 万象有声,一个专为有声创作者打造的新一代智能有声内容创作平台。平台提供专业的智能拆章、智能画本编辑、AI配音、AI生成音效、后期制作、智能对轨、智能审听等有声创作全流程工具,可以帮助创作者高效、低成本创作出引人入胜的有声作品。立即体验,让有声书制作更简单!
- 3395次使用
-
- Go语言文件锁操作
- 2023-01-07 225浏览
-
- Go语言文件的写入、追加、读取、复制操作
- 2022-12-30 389浏览
-
- Go语言从INI配置文件中读取需要的值
- 2022-12-23 250浏览
-
- Go语言并发目录遍历
- 2023-01-07 137浏览
-
- Go语言使用切片读写文件
- 2023-02-25 190浏览

