京公网安备 11010802034615号
经营许可证编号:京B2-20210330
来源:早起Python
作者:刘早起
大家好,我是早起。
在之前的办公自动化系列文章中,曾经介绍过很多将Excel指定字段提取到Word模版中指定位置的案例
从Excel到Word批量制作合同
在上述案例中,都要求有一个现成的Word模版才可以执行,那么如果现在没有Word模版,要求针对Excel指定内容批量生成Word该如何实现?
本文就将基于一个真实的办公案例进行讲解如何提取Excel内容并创建Word,主要将涉及以下三个知识点
“openpyxl 读取 Excel 文件python-docx 写入 Word 文件python-docx 各类样式的设计和调整”
你是公司的底层小虾米,前段时间收集了公司各个部门的请假信息汇总表如下:
现在你需要根据表格中每个人的信息依次生成各自的请假条如下:
需求的特殊性在于没有现成的模板,因此需要在代码中同时完成模板的制作和文字、段落样式设计。
比较复杂的文字版面更建议直接设计好模板,以及确定好程序识别位置的定位符,详细内容可以参考之前的教程:批量生成合同
整个需求的实现逻辑很简单,主要分为以下 2 步:
“
获取 Excel 文件中每一行的信息,提取 5 个参数;结合获取的参数设计请假条样式并输出
”
逻辑并不困难,但是复杂的地方在于用代码输出请假条的过程,包括加粗、字号、下划线等等。
需求中的请假信息汇总表为 Leave.xlsx,已放链接供练习下载 首先读取请假信息表,尝试获取除表头外实际信息的 5 个参数:
from openpyxl import load_workbook
path = r'C:xxx' # 路径为Excel 文件所在的位置,可按实际情况更改
workbook = load_workbook(path + r'Leave.xlsx')
sheet = workbook.active
n = 0 for row in sheet.rows:
if n:
for cell in row:
print(cell.value)
n += 1
通过 for row in sheet.rows 和 for cell in row 就可以迭代 Excel 中有数据的每个单元格了。
循环体中加上对 n 的判断是为了跳过表头 如果让输出更加直观可以稍微修改上面的代码:
n = 0 for row in sheet.rows:
if n:
for cell in row:
print(cell.value, end=', ')
print('')
n += 1
信息已经获取到了,但我们也发现申请日期是 datetime 形式,因此我们需要利用 datetime 库获取其中的日期成分,也可以转化为字符串后利用空格切片:
n = 0 for row in sheet.rows:
if n:
name = row[0].value department = row[1].value
reason = row[2].value days = row[3].value
date = str(row[4].value).split()[0]
print(name, department, reason, days, date)
n += 1
提取到信息后就可以在循环体内建立个“请假条函数”,即把每条记录的 5 个变量传入函数,在函数中生成完整请假条并保存,即修改成如下形式:
def request_for_leave(name, department, reason, days, date):
pass
n = 0 for row in sheet.rows:
if n:
name = row[0].value department = row[1].value
reason = row[2].value days = row[3].value date = str(row[4].value).split()[0]
request_for_leave(name, department, reason, days, date)
n += 1
生成请假条中,首先导入依赖的库 python-docx 以及跟样式设置有关的相应方法:
# 读取 Word 文件 from docx import Document # 文件涉及段落样式修改 from docx.enum.text
import WD_PARAGRAPH_ALIGNMENT # 文件涉及文字样式修改:颜色修改、字号调整 from docx.shared
import RGBColor, Pt # 设置中文字体 from docx.oxml.ns import qn
接下来就是依次添加各部分的内容和样式,因为全文的字体均为楷体,可以在函数体的最末尾一并修改。首先实例化文件后添加“请假条”:
def request_for_leave(name, department, reason, days, date): doc = Document()
heading_1 = '请 假 条' paragraph_1 = doc.add_heading(heading_1, level=1)
# 居中对齐 paragraph_1.alignment = WD_PARAGRAPH_ALIGNMENT.CENTER
# 标题要打,单独修改较大字号 for run in paragraph_1.runs:
run.font.size = Pt(17)
如果对上面的代码单独输出会发现标题颜色是蓝色,这是以 .add_heading() 添加标题默认的颜色。
最后也可以统一修改 对于“尊敬的领导:”这一行基本同理,但不需要修改字号:
greeting_word = '尊敬的领导:' paragraph_2 = doc.add_paragraph(greeting_word)
接下来是核心请假条的正文了,从需求中的样式上可以看出,整句话中有一些文字块是固定的,包括 “本人” “、所在部门” “,由于” “需请假” “天。”,而几个文字块之间的信息是根据不同人的情况而不同,并且需要添加下划线。
简单的逻辑就是将参数对应的文字块添加好下划线之后,和固有不变的变量进行拼接,就可以形成完整的段落了:
word_1 = " 本人" word_2 = ",所在部门" word_3 = ",由于"
word_4 = ",需请假" word_5 = "天。" paragraph_3 = doc.add_paragraph()
paragraph_3.add_run(word_1)
paragraph_3.add_run(name).underline = True paragraph_3.add_run(word_2)
paragraph_3.add_run(department).underline = True paragraph_3.add_run(word_3)
paragraph_3.add_run(reason).underline = True paragraph_3.add_run(word_4)
paragraph_3.add_run(str(days)).underline = True paragraph_3.add_run(word_5)
# 设置下划线 paragraph_3.paragraph_format.line_spacing = 1.5
代码中 .underline = True 就是对参数对应的文字块添加下划线 接下来的申请人和日期填写就和上面基本类似。
比较大的区别在于添加了一行新的命令 paragraph.alignment =
WD_PARAGRAPH_ALIGNMENT.RIGHT, 这行命令能够将这两个段落右对齐:
word_6 = '申请人:' paragraph_4 = doc.add_paragraph()
paragraph_4.add_run(word_6)
paragraph_4.add_run(name).underline = True
paragraph_4.alignment = WD_PARAGRAPH_ALIGNMENT.RIGHT
word_7 = '日期:' sign_date = "{}年{}月{}日".format(date.split('-')[0],
date.split('-')[1], date.split('-')[2])
paragraph_5 = doc.add_paragraph()
paragraph_5.add_run(word_7)
paragraph_5.add_run(sign_date).underline = True
paragraph_5.alignment = WD_PARAGRAPH_ALIGNMENT.RIGHT
最后就是统一修改字体为楷体,中文字体修改比较麻烦,不像英文字体只需要指定如 run.font.name = 'Arial' 就可以,需要额外的几行代码。最后记得保存:
for paragraph in doc.paragraphs:
for run in paragraph.runs:
# 统一修改颜色 run.font.color.rgb = RGBColor(0, 0, 0)
run.font.name = '楷体' r = run._element.rPr.rFonts
r.set(qn('w:eastAsia'), '楷体')
doc.save(path + "{}-请假条.docx".format(name))
运行上述代码即可针对每个人产生相应的请假条:
至此,我们就成功利用Python实现了开头的需求,解放双手。注意本案例同样适用于邀请函、证明等各类文书的制作,大家可以举一反三。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
平均数是数据分析、数理统计与日常运算中最基础、最常用的统计量,核心作用是浓缩一组数据的整体水平、刻画数据集中趋势。在众多 ...
2026-08-24在MySQL数据库中,InnoDB存储引擎作为主流事务型引擎,默认事务隔离级别为可重复读(Repeatable Read,RR),这与SQL Server、Or ...
2026-08-24 很多数据分析师拿到数据就开始清洗、建模,但当被问到“这批数据属于什么类型——结构化还是非结构化?分类变量还是数值变量 ...
2026-08-24 很多数据分析师画过趋势图、做过业绩预测,但当被问到“这个月销售额增长20%,到底是长期趋势自然增长,还是促销活动的短期 ...
2026-08-21在数据分析与数据可视化工作中,直方图是展示数据分布特征、离散程度、集中区间的核心图表,能够直观呈现数值数据的频次分布规律 ...
2026-08-20在数据分析领域有一句核心准则:垃圾数据进,垃圾数据出。数据清洗是数据分析、数据建模、数据可视化之前的必经前置工序,也是保 ...
2026-08-20 很多数据分析师做过按月份的销售额趋势图,画过按天的流量折线图,但当被问到“时间序列和普通数据有什么本质区别”“季节性 ...
2026-08-20在Python数据分析与数据清洗工作中,Pandas是最核心的数据处理库,DataFrame是结构化数据的标准存储格式。在实时数据采集、循环 ...
2026-08-19在零售行业大数据分析与精细化运营领域,纸尿裤旁摆放啤酒是最经典、最具代表性的商业案例。两种看似毫无关联的商品,一个是婴幼 ...
2026-08-19 很多数据分析师能熟练地计算指标、搭建标签体系,但当被问到“画像到底在解决什么问题”“画像和标签是什么关系”“画像如何 ...
2026-08-19在数据分析、业务监控、质量检测与风险管控工作中,数据波动性是衡量数据稳定性、业务健康度、结果可信度的核心依据。数据波动代 ...
2026-08-18很多分析师在设计标签时思路清晰,但真到落地环节却面临“数据在手,不知如何转化为可用标签”的困境:或因加工方式选择不当导致 ...
2026-08-18在数据分析、业务评价、产品评级、用户分层与综合决策场景中,单一指标往往无法全面、客观地评价事物整体水平。现实中的评价对象 ...
2026-08-18在数理统计、假设检验、数据分析与机器学习领域中,卡方分布(χ²分布)是继正态分布、t分布之后最重要的连续型概率分布之一。 ...
2026-08-17在Python数据清洗、文本校验、账号密码规则校验、脏数据过滤、字符串规整化处理中,正则表达式是最高效、最常用的文本匹配工具。 ...
2026-08-17 很多分析师每天和数据打交道,但当被问到“标签是什么”“标签和指标有什么区别”“标签体系如何设计”时,却常常答不上来。 ...
2026-08-17手游行业具备用户迭代快、竞争激烈、用户粘性易流失的典型特征。随着新游持续上线、玩家审美升级、玩法疲劳等问题出现,存量用户 ...
2026-08-14在数字化产品运营、商业数据分析、业务增长管理中,零散的指标统计无法支撑系统性的业务决策。单一的点击率、转化率、销量数据只 ...
2026-08-14 很多数据分析师每天都在写SQL,但当被问到“数据查询语言(DQL)的本质是什么”“SELECT语句中各子句的书写顺序与实际执行顺 ...
2026-08-14在数据库数据分析、数据清洗、报表统计与业务查询场景中,日期时间是最高频、最核心的基础字段。数据库中存储的日期格式多样,包 ...
2026-08-13