在企业数字化进程中,电子合同、申请表、报销单、问卷等场景大量依赖 pdf 表单(acroform)进行数据采集。传统做法是先用 adobe acrobat 或在线编辑器手工绘制表单字段,再由业务人员逐份打开、逐字段录入,面对批量合同时不仅耗时,还容易出现字段填错、漏填、格式不一致等问题。当表单需要对接审批系统、crm 或归档数据库时,纯人工方式更难以满足合规与效率要求。
将表单的"创建—填写—提取—固化"全流程交给代码自动完成,可以让一份合同模板在数秒内生成数十份差异化合同,并在签署后自动回收关键字段进入业务系统。这种方式特别适用于人力资源合同、采购订单、供应商协议、用户调研问卷等高频、强结构化的场景。
本文将以一份"供应商合作协议"为线索,演示如何使用 python 完成 pdf 表单的创建、批量自动填写、字段值提取以及表单固化(flatten)等关键操作,构建一条可复用的电子合同自动化流水线。
本文使用的方法需要用到 free spire.pdf for python,可通过 pip 安装:
pip install spire.pdf.free
1. 创建 pdf 电子合同表单模板
电子合同的第一步是生成带有可填写字段的 pdf 模板。我们先用代码在空白页面上绘制合同标题、说明文字,并添加文本框字段与列表框字段,搭建出一份可分发的空白合同模板。
from spire.pdf.common import *
from spire.pdf import *
outputfile = "contracttemplate.pdf"
# 创建 pdf 文档
doc = pdfdocument()
# 允许在已有文档上创建表单(新建文档时也建议显式设置)
doc.allowcreateform = true
# 添加一个页面
page = doc.pages.add()
# 创建字体与画刷
titlefont = pdftruetypefont("微软雅黑", 18.0, pdffontstyle.bold, true)
labelfont = pdftruetypefont("微软雅黑", 11.0, pdffontstyle.regular, true)
fieldfont = pdftruetypefont("宋体", 11.0, pdffontstyle.regular, true)
brush = pdfbrushes.get_black()
hintbrush = pdfbrushes.get_dodgerblue()
# 绘制合同标题
titleformat = pdfstringformat(pdftextalignment.center)
page.canvas.drawstring("供应商合作协议", titlefont, brush,
page.canvas.clientsize.width / float(2), 40.0, titleformat)
# 绘制说明文字
page.canvas.drawstring("请填写以下字段后签署,带 * 字段为必填项。", labelfont, hintbrush, 50.0, 80.0)
# 字段起始坐标
x = 50.0
y = 120.0
labelgap = 15.0
fieldwidth = 200.0
fieldheight = 18.0
# 1) 添加"供应商名称"文本框字段
label1 = "供应商名称 *:"
page.canvas.drawstring(label1, labelfont, brush, x, y)
textx = x + labelfont.measurestring(label1).width + labelgap
textboxname = pdftextboxfield(page, "vendor_name")
textboxname.bounds = rectanglef(textx, y, fieldwidth, fieldheight)
textboxname.borderwidth = 0.75
textboxname.borderstyle = pdfborderstyle.solid
textboxname.font = fieldfont
doc.form.fields.add(textboxname)
# 2) 添加"统一社会信用代码"文本框字段
y = y + 40.0
label2 = "信用代码 *:"
page.canvas.drawstring(label2, labelfont, brush, x, y)
textx = x + labelfont.measurestring(label2).width + labelgap
textboxcode = pdftextboxfield(page, "credit_code")
textboxcode.bounds = rectanglef(textx, y, fieldwidth, fieldheight)
textboxcode.borderwidth = 0.75
textboxcode.borderstyle = pdfborderstyle.solid
textboxcode.font = fieldfont
doc.form.fields.add(textboxcode)
# 3) 添加"合同金额(元)"文本框字段
y = y + 40.0
label3 = "合同金额 *:"
page.canvas.drawstring(label3, labelfont, brush, x, y)
textx = x + labelfont.measurestring(label3).width + labelgap
textboxamount = pdftextboxfield(page, "amount")
textboxamount.bounds = rectanglef(textx, y, fieldwidth, fieldheight)
textboxamount.borderwidth = 0.75
textboxamount.borderstyle = pdfborderstyle.solid
textboxamount.font = fieldfont
doc.form.fields.add(textboxamount)
# 4) 添加"签署日期"文本框字段
y = y + 40.0
label4 = "签署日期 *:"
page.canvas.drawstring(label4, labelfont, brush, x, y)
textx = x + labelfont.measurestring(label4).width + labelgap
textboxdate = pdftextboxfield(page, "sign_date")
textboxdate.bounds = rectanglef(textx, y, fieldwidth, fieldheight)
textboxdate.borderwidth = 0.75
textboxdate.borderstyle = pdfborderstyle.solid
textboxdate.font = fieldfont
doc.form.fields.add(textboxdate)
# 5) 添加"付款方式"列表框字段
y = y + 40.0
label5 = "付款方式 *:"
page.canvas.drawstring(label5, labelfont, brush, x, y)
textx = x + labelfont.measurestring(label5).width + labelgap
listboxpayment = pdflistboxfield(page, "payment_method")
listboxpayment.items.add(pdflistfielditem("一次性付清", "pay_once"))
listboxpayment.items.add(pdflistfielditem("分期付款(按月)", "pay_monthly"))
listboxpayment.items.add(pdflistfielditem("分期付款(按季)", "pay_quarterly"))
listboxpayment.items.add(pdflistfielditem("验收后付款", "pay_after_accept"))
listboxpayment.bounds = rectanglef(textx, y, fieldwidth, 60.0)
listboxpayment.font = fieldfont
listboxpayment.selectedindex = 0
doc.form.fields.add(listboxpayment)
# 保存模板
doc.savetofile(outputfile, fileformat.pdf)
doc.close()说明:
pdfdocument()创建一份新的 pdf 文档,allowcreateform = true显式开启表单创建能力。pdftextboxfield(page, "name")在指定页面上生成一个文本框字段,字段名是后续填写与提取的索引依据。pdflistboxfield(page, "name")生成列表框字段,通过items.add(pdflistfielditem(...))逐项添加可选项,selectedindex设置默认选中项。bounds = rectanglef(x, y, w, h)精确控制字段在页面上的位置与尺寸,配合measurestring计算标签宽度,保证标签与字段对齐。- 所有字段最终通过
doc.form.fields.add(...)注册到文档表单集合中。
此步骤的作用是生成一份可分发的空白合同模板,为后续批量自动填写奠定基础。

2. 自动填写电子合同表单
模板生成后,实际业务中往往需要根据数据库或 excel 中的供应商信息批量填写合同。下面演示如何加载模板,遍历表单字段并按业务数据自动填充。
from spire.pdf.common import *
from spire.pdf import *
inputfile = "contracttemplate.pdf"
outputfile = "filledcontract.pdf"
# 加载合同模板
doc = pdfdocument()
doc.loadfromfile(inputfile)
# 获取表单并转换为 formwidget
pdfform = doc.form
formwidget = pdfformwidget(pdfform)
# 业务数据:来自数据库或 excel 的供应商信息
vendordata = {
"vendor_name": "成都**科技有限公司",
"credit_code": "91510100ma6xxxxxx9x",
"amount": "128000.00",
"sign_date": "2026-08-28"
}
# 遍历所有字段并按名称填充
if formwidget.fieldswidget.count > 0:
for i in range(formwidget.fieldswidget.count):
field = formwidget.fieldswidget.get_item(i)
# 处理文本框字段
if isinstance(field, pdftextboxfieldwidget):
textboxfield = field if isinstance(field, pdftextboxfieldwidget) else none
if textboxfield.name in vendordata:
textboxfield.text = vendordata[textboxfield.name]
# 处理列表框字段
if isinstance(field, pdflistboxwidgetfieldwidget):
listboxfield = field if isinstance(field, pdflistboxwidgetfieldwidget) else none
if listboxfield.name == "payment_method":
# 选择"分期付款(按月)"
listboxfield.selectedindex = [1]
# 保存填写后的合同
doc.savetofile(outputfile)
doc.close()说明:
pdfformwidget(pdfform)将表单对象转换为可操作的formwidget,fieldswidget即字段集合。get_item(i)按索引取出字段,再通过isinstance判断字段类型,避免类型转换异常。pdftextboxfieldwidget通过text属性写入文本;pdflistboxwidgetfieldwidget通过selectedindex(列表)设置选中项。- 业务数据用字典维护,字段名作为 key,与模板中字段名一一对应,便于从数据库或 excel 批量灌入。
此步骤实现了"模板 + 数据 = 合同"的自动化填充,是批量出合同的核心环节。

批量生成多份合同
将上述填充逻辑封装为函数,即可根据供应商列表批量生成合同:
from spire.pdf.common import *
from spire.pdf import *
def fillcontract(templatepath, outputpath, vendordata, paymentindex):
doc = pdfdocument()
doc.loadfromfile(templatepath)
formwidget = pdfformwidget(doc.form)
if formwidget.fieldswidget.count > 0:
for i in range(formwidget.fieldswidget.count):
field = formwidget.fieldswidget.get_item(i)
if isinstance(field, pdftextboxfieldwidget):
textboxfield = field if isinstance(field, pdftextboxfieldwidget) else none
if textboxfield.name in vendordata:
textboxfield.text = vendordata[textboxfield.name]
if isinstance(field, pdflistboxwidgetfieldwidget):
listboxfield = field if isinstance(field, pdflistboxwidgetfieldwidget) else none
if listboxfield.name == "payment_method":
listboxfield.selectedindex = [paymentindex]
doc.savetofile(outputpath)
doc.close()
# 供应商列表(实际来自数据库查询)
vendors = [
{"vendor_name": "成都云启科技有限公司", "credit_code": "91510100ma6xxxxxx9x",
"amount": "128000.00", "sign_date": "2026-08-28"},
{"vendor_name": "深圳前海数据服务有限公司", "credit_code": "91440300ma5xxxxxx3x",
"amount": "86500.00", "sign_date": "2026-08-28"},
{"vendor_name": "杭州数澜科技股份有限公司", "credit_code": "91330106ma2xxxxxx1x",
"amount": "210000.00", "sign_date": "2026-08-28"},
]
# 批量生成
for idx, vendor in enumerate(vendors):
fillcontract("contracttemplate.pdf", f"contracts/contract_{idx + 1}.pdf", vendor, 0)说明:
- 将单份填写逻辑封装为
fillcontract函数,模板路径、输出路径、业务数据、付款方式索引均参数化。 - 外层循环遍历供应商列表,依次生成
contract_1.pdf、contract_2.pdf…… - 实际项目中,
vendors可直接来自数据库查询结果或 excel 读取,实现真正的"数据驱动出合同"。
3. 提取表单字段数据用于归档与校验
合同签署回收后,业务系统通常需要把表单中的关键字段读出来归档、入库或与原始订单校验。下面演示如何遍历所有字段并提取其值。
from spire.pdf.common import *
from spire.pdf import *
inputfile = "filledcontract.pdf"
outputfile = "extractedformdata.txt"
# 加载已填写的合同
doc = pdfdocument()
doc.loadfromfile(inputfile)
formwidget = pdfformwidget(doc.form)
result = []
if formwidget.fieldswidget.count > 0:
for i in range(formwidget.fieldswidget.count):
field = formwidget.fieldswidget.get_item(i)
# 提取文本框字段值
if isinstance(field, pdftextboxfieldwidget):
textboxfield = field if isinstance(field, pdftextboxfieldwidget) else none
result.append(f"字段名:{textboxfield.name},值:{textboxfield.text}")
# 提取列表框字段值
if isinstance(field, pdflistboxwidgetfieldwidget):
listboxfield = field if isinstance(field, pdflistboxwidgetfieldwidget) else none
selectedvalue = listboxfield.selectedvalue
result.append(f"字段名:{listboxfield.name},选中值:{selectedvalue}")
# 保存提取结果
with open(outputfile, "w", encoding="utf-8") as f:
for line in result:
f.write(line + "\n")
doc.close()说明:
pdftextboxfieldwidget.text直接返回文本框当前值。pdflistboxwidgetfieldwidget.selectedvalue返回列表框当前选中项的值。- 提取结果写入文本文件,实际项目中可改为写入数据库或 json,供审批系统消费。
- 这一步是"签署回收 → 数据回流"的关键,让 pdf 表单不再是信息孤岛。
4. 表单字段管理:必填、修改、扁平化与删除
在合同流程的不同阶段,往往需要对表单字段做进一步管理:起草时标记必填、审批时修改个别字段、签署完成后扁平化防止篡改、归档前删除临时字段。
4.1 设置必填字段与修改字段值
from spire.pdf.common import *
from spire.pdf import *
inputfile = "contracttemplate.pdf"
outputfile = "managedcontract.pdf"
doc = pdfdocument()
doc.loadfromfile(inputfile)
formwidget = pdfformwidget(doc.form)
if formwidget.fieldswidget.count > 0:
for i in range(formwidget.fieldswidget.count):
field = formwidget.fieldswidget.get_item(i)
if isinstance(field, pdftextboxfieldwidget):
textboxfield = field if isinstance(field, pdftextboxfieldwidget) else none
# 将关键字段标记为必填
if textboxfield.name in ["vendor_name", "credit_code", "amount", "sign_date"]:
textboxfield.required = true
# 为字段设置统一字体,提升填写后的视觉效果
textboxfield.font = pdftruetypefont("宋体", 11.0, pdffontstyle.regular, true)
# 保存
doc.savetofile(outputfile)
doc.close()说明:
required = true将字段标记为必填,pdf 阅读器会以高亮边框提示填写人。font = pdftruetypefont(...)为字段统一设置字体,避免不同填写端字体差异导致排版错乱。
4.2 扁平化表单防止二次修改
合同签署完成后,通常需要将表单字段"烧录"成静态内容,防止后续被篡改:
from spire.pdf.common import * from spire.pdf import * inputfile = "filledcontract.pdf" outputfile = "flattenedcontract.pdf" doc = pdfdocument() doc.loadfromfile(inputfile) # 扁平化所有表单字段:字段值转为普通文本,不再可编辑 doc.form.isflatten = true doc.savetofile(outputfile) doc.close()
说明:
doc.form.isflatten = true一行即可将整份文档的所有表单字段扁平化。- 扁平化后字段值变为页面上的普通文本,任何 pdf 阅读器都无法再修改,适合作为最终归档版本。
- 这是电子合同"签署即固化"的关键操作,常与数字签名配合使用。
4.3 删除指定字段
在模板复用场景中,有时需要从已有表单中移除某些不再使用的字段:
from spire.pdf.common import *
from spire.pdf import *
inputfile = "contracttemplate.pdf"
outputfile = "removedfieldcontract.pdf"
doc = pdfdocument()
doc.loadfromfile(inputfile)
formwidget = pdfformwidget(doc.form)
if formwidget.fieldswidget.count > 0:
i = 0
while i < formwidget.fieldswidget.count:
field = formwidget.fieldswidget.get_item(i)
if isinstance(field, pdftextboxfieldwidget):
textboxfield = field if isinstance(field, pdftextboxfieldwidget) else none
# 删除"签署日期"字段
if textboxfield.name == "sign_date":
formwidget.fieldswidget.remove(textboxfield)
continue
i = i + 1
doc.savetofile(outputfile)
doc.close()说明:
formwidget.fieldswidget.remove(field)从表单中移除指定字段。- 删除操作会改变字段集合长度,因此使用
while循环配合索引手动递增,删除时continue跳过索引递增,避免越界。 - 此操作适用于模板迭代、字段清理等场景。
关键类与方法说明表
为便于查阅,下面整理本文中主要使用到的类、属性与方法。
| 类 / 方法 | 说明 |
|---|---|
pdfdocument | pdf 文档对象,负责创建、加载与保存文档 |
pdfdocument.allowcreateform | 是否允许在文档上创建表单字段 |
pdfdocument.form | 获取文档的表单对象 |
pdfformwidget | 表单操作对象,提供 fieldswidget 字段集合 |
fieldswidget.get_item(i) | 按索引获取字段 |
fieldswidget.remove(field) | 移除指定字段 |
pdftextboxfield(page, name) | 创建文本框字段 |
pdflistboxfield(page, name) | 创建列表框字段 |
pdflistfielditem(text, value) | 列表框/组合框的选项项 |
pdftextboxfieldwidget | 文本框字段操作对象,可读写 text、required、font 等 |
pdflistboxwidgetfieldwidget | 列表框字段操作对象,可读写 selectedindex、selectedvalue |
field.bounds = rectanglef(x, y, w, h) | 设置字段位置与尺寸 |
field.borderstyle / field.borderwidth | 设置字段边框样式与宽度 |
pdftruetypefont(name, size, style, true) | 创建 truetype 字体,用于页面绘制与字段字体设置 |
pdfbrushes.get_black() | 获取黑色画刷,用于绘制文本 |
page.canvas.drawstring(...) | 在页面上绘制文本 |
doc.form.isflatten = true | 扁平化所有表单字段,转为静态文本 |
总结
通过本文示例,你已经了解如何使用 python 完成 pdf 电子合同表单的完整生命周期管理:从创建带字段的合同模板,到根据业务数据批量自动填写,再到签署后提取字段值回流业务系统,最后通过扁平化固化签署结果。整个过程高度自动化,特别适用于供应商协议、人事合同、采购订单等高频、强结构化场景。
相比手工在 acrobat 中逐份填写,代码方式具有批量处理、字段校验、与业务系统无缝对接等优势。你可以在此基础上扩展更多能力,例如结合数字签名保障法律效力、对接数据库实现合同台账自动入库、用 ocr 识别纸质合同回填电子表单等,构建完整的电子合同管理闭环。
到此这篇关于使用python在pdf文档中自动创建与填写表单的文章就介绍到这了,更多相关python pdf创建与填写表单内容请搜索代码网以前的文章或继续浏览下面的相关文章希望大家以后多多支持代码网!
发表评论