京公网安备 11010802034615号
经营许可证编号:京B2-20210330
来源:早起Python
作者:陈熹、刘早起
大家好,又到了Python办公自动化(偷懒)专题。
今天介绍的案例是如何利用Python来自动化移动、修改、重命名文件/夹,这样的操作在日常办公中经常会用到,若能掌握用Python实现将会大大提高效率!
所以我希望能够通过这篇文章来让大家了解:如何基于 os glob 和 shutil 对文件管理的综合运用!
为了让本文介绍的案例更有通用型,我新建了一个文件夹 files1 存放着 1800+ 个文件,如下所示:
需要完成的内容如下
“
将 1835 个文件移动到新文件夹 file2,并且重命名文件,名字开头加上 序号 和 “终稿” 两个字,如名字更改为 “1-终稿-xxxxx(原文件名)”
”
你心里可能想着:这是人做的事??? 但确实这是真实的需求,文件批量重命名非常常见,如果没有一些技巧,那么只能耗费大量的时间和人力去做。这里的技巧,就是 Python
另外还有一个问题:要先移动再重命名还是先重命名再移动呢? 继续往下看!
真实的办公场景并不会这样的需求,毕竟谁想要无端给自己的电脑产生大量无用文件呢(也不要给别人的电脑乱用)
不得不提,生成随机文件能够帮助我们更好的测试自己 Python 文件管理的技能。如果你没有合适的文件夹和文件夹供自己练习,那么为什么不自己写个代码产生呢?
当然,在这个过程中我们也会学习一些知识点,先看代码:
import random import string for i in range(2000):
random_str = ''.join(random.sample(string.ascii_letters + string.digits, random.randint(1, 11)))
file = open(r"C:\xxx\file1" + random_str + ".txt", 'w+') # 前面路径是产生文件的目标文件夹
file.write(''.join(random.sample(string.ascii_letters + string.digits, random.randint(1, 11))))
file.close()
通过 string 就可以获得所有的字母和数字,利用 random.sample() 常规接受两个参数,一个是抽样的范围,一个是抽样的次数,默认是放回抽样。这样就可以在给定的字母数字范围内随机抽取 1-10 个,但是返回的结果注意是列表,需要再用 .join 方法完成字符串拼接
用随机产生的名字生成文件后,再在其内部用类似的方法随机写入一些内容:
上面的写法不够优雅,因为需要配套使用 file.close() 释放,更好的方法是直接利用上下文管理器 with 结构,减少出错的几率
import random import string for i in range(2000):
random_str = ''.join(random.sample(string.ascii_letters + string.digits, random.randint(1, 11)))
with open(r"C:\xxx\file1" + random_str + ".txt", 'w+') as file:
file.write(''.join(random.sample(string.ascii_letters + string.digits, random.randint(1, 11))))
因为即使是随机产生名字,但抽样的范围和次数不大决定了 2000 次抽样会有一些抽签组合成的名字完全一样,后面形成的文件会覆盖之前产生的文件,最终导致产生的文件没有 2000 个。
需要用到内置库 os 的 os.rename() 方法
import os os.rename('practice.txt', 'practice_rename.txt') # 重命名文件 os.rename('文件夹1', '文件夹2') # 重命名文件夹
虽然需求中有重命名文件的需求,但实际上并不需要直接借助这个方法
需要用到内置库 shutil 的 shutil.move 方法
import shutil
shutil.move(r'.practice.txt', r'.文件夹1/')
shutil.move(r'.practice.txt', r'.文件夹1/new.txt')
注意到上面后两行代码的区别吗?前一行是将目标文件移动到目标文件夹里,而后一行,在将目标文件移动到目标文件夹里的同时,能够对其进行重命名
也就是说,我们并不需要用 os.rename 先命名文件再用 shutil.move 将其移动的指定文件夹,而是可以用 shutil.move 一步到位。
采用基于 glob 库的迭代框架:
import glob
path = xxx for file in glob.glob(f'{path}/**/*.xlsx', recursive=True):
pass
上面的代码能够获取给定路径内部所有文件夹下的 Excel 文件(.xlsx 格式), recursive 参数默认为 False,当为 True 时允许逐级遍历
而本例需要获取给定文件夹下的所有 .txt 文件,则更加简单:
import glob
path = xxx for file in glob.glob(f'{path}/*.txt'):
pass
在上面一节我们已经把需求拆分为多个小块并理清了思路,现在可以开始写代码了。首先导入需要的库
import os import shutil import glob
path = r"C:xxx" # 存放大量需更名移动文件的文件夹路径的上一级路径
上文提到,不需要利用 os.rename 那为什么要导入 os 库呢?
一方面因为要通过这个库产生新的文件夹。也可以手动完成,但交给代码多了判断也不容易出错:
if not os.path.exists(path + r'file2'):
os.mkdir(path + r'file2')
另一方面下文还会用它获取文件名,然后就可以移动更名一步到位,glob 迭代文件框架遍历获取文件绝对路径:
count = 1 # 生成序号 for file in glob.glob(f'{path}\测试\*.txt'):
# 这里是文件绝对路径,可以用字符串方法直接替换修改,但为了方便理解我还是用路径拼接 filename = os.path.basename(file)
shutil.move(file, path + r'file2' + f'{count}-终稿-{filename}')
count += 1
看到没,Python、3秒、搞定、干饭!
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在机器学习建模与数据分析实战中,特征维度爆炸、冗余信息干扰、模型泛化能力差是高频痛点。面对用户画像、企业经营、医疗检测、 ...
2026-03-26在这个数据无处不在的时代,数据分析能力已不再是数据从业者的专属技能,而是成为了职场人、管理者、创业者乃至个人发展的核心竞 ...
2026-03-26在CDA(Certified Data Analyst)数据分析师的能力体系中,线性回归是连接描述性统计与预测性分析的关键桥梁,也是CDA二级认证的 ...
2026-03-26在数据分析、市场研究、用户画像构建、学术研究等场景中,我们常常会遇到多维度、多指标的数据难题:比如调研用户消费行为时,收 ...
2026-03-25在流量红利见顶、获客成本持续攀升的当下,营销正从“广撒网”的经验主义,转向“精耕细作”的数据驱动主义。数据不再是营销的辅 ...
2026-03-25在CDA(Certified Data Analyst)数据分析师的全流程工作中,无论是前期的数据探索、影响因素排查,还是中期的特征筛选、模型搭 ...
2026-03-25在当下数据驱动决策的职场环境中,A/B测试早已成为互联网产品、运营、营销乃至产品迭代优化的核心手段,小到一个按钮的颜色、文 ...
2026-03-24在统计学数据分析中,尤其是分类数据的分析场景里,卡方检验和显著性检验是两个高频出现的概念,很多初学者甚至有一定统计基础的 ...
2026-03-24在CDA(Certified Data Analyst)数据分析师的日常业务分析与统计建模工作中,多组数据差异对比是高频且核心的分析场景。比如验 ...
2026-03-24日常用Excel做数据管理、台账维护、报表整理时,添加备注列是高频操作——用来标注异常、说明业务背景、记录处理进度、补充关键 ...
2026-03-23作为业内主流的自助式数据可视化工具,Tableau凭借拖拽式操作、强大的数据联动能力、灵活的仪表板搭建,成为数据分析师、业务人 ...
2026-03-23在CDA(Certified Data Analyst)数据分析师的日常工作与认证考核中,分类变量的关联分析是高频核心场景。用户性别是否影响商品 ...
2026-03-23在数据工作的全流程中,数据清洗是最基础、最耗时,同时也是最关键的核心环节,无论后续是做常规数据分析、可视化报表,还是开展 ...
2026-03-20在大数据与数据驱动决策的当下,“数据分析”与“数据挖掘”是高频出现的两个核心概念,也是很多职场人、入门学习者容易混淆的术 ...
2026-03-20在CDA(Certified Data Analyst)数据分析师的全流程工作闭环中,统计制图是连接严谨统计分析与高效业务沟通的关键纽带,更是CDA ...
2026-03-20在MySQL数据库优化中,分区表是处理海量数据的核心手段——通过将大表按分区键(如时间、地域、ID范围)分割为多个独立的小分区 ...
2026-03-19在商业智能与数据可视化领域,同比、环比增长率是分析数据变化趋势的核心指标——同比(YoY)聚焦“长期趋势”,通过当前周期与 ...
2026-03-19在数据分析与建模领域,流传着一句行业共识:“数据决定上限,特征决定下限”。对CDA(Certified Data Analyst)数据分析师而言 ...
2026-03-19机器学习算法工程的核心价值,在于将理论算法转化为可落地、可复用、高可靠的工程化解决方案,解决实际业务中的痛点问题。不同于 ...
2026-03-18在动态系统状态估计与目标跟踪领域,高精度、高鲁棒性的状态感知是机器人导航、自动驾驶、工业控制、目标检测等场景的核心需求。 ...
2026-03-18