Python办公自动化之调用Word实现批量DOC转PDF并保留原格式
作者:Li Ming&
前言
前面两篇文章我们分别实现了 PDF转图片 和 PPT转PDF,今天带来办公自动化三部曲的最后一环——Word批量转PDF。
你是否遇到过这些场景:
- 收集了十几个同事的Word文档,需要统一转成PDF发给客户(防止排版错乱);
- 论文、标书需要以PDF格式提交,但Word版本众多,一个个打开另存为太耗时;
- 希望保留Word中的书签、目录结构,PDF中能自动生成导航。
今天我就用 Python 的 pywin32(调用 Microsoft Word 的 COM 接口)来快速实现批量转换,不仅保留原始排版,连书签都能完美带过来。而且代码完全动态路径,放在任何文件夹都能直接运行。
左下角打开Python终端,使用阿里云镜像快速安装:
pip install pywin32 -i https://mirrors.aliyun.com/pypi/simple/

pywin32 是 Python 调用 Windows API 和 COM 组件的桥梁,我们通过它来控制 Word 应用程序。
完整代码


# -*- coding: utf-8 -*-
'''
Python批量将Word文件(DOC/DOCX)转为PDF文件
功能:自动识别当前目录下所有Word文档,调用本地Word转为PDF
'''
#pip install pywin32 -i https://mirrors.aliyun.com/pypi/simple/ 安装包
import os #导入内置系统的模块,用来遍历文件架里的所有文件。
from win32com.client import Dispatch, constants, gencache #导入第三方软件库的工具
def doc2pdf(word_file, pdf_file):
'''
单个Word转PDF
word_file: Word文件完整路径
pdf_file: 输出PDF完整路径
'''
word = gencache.EnsureDispatch('Word.Application')
doc = word.Documents.Open(word_file, ReadOnly=1)
# 导出为PDF(关键参数)
doc.ExportAsFixedFormat(pdf_file,
constants.wdExportFormatPDF,
Item=constants.wdExportDocumentWithMarkup,
CreateBookmarks=constants.wdExportCreateHeadingBookmarks)
word.Quit(constants.wdDoNotSaveChanges)
print(f'✅ 转换成功:{os.path.basename(word_file)} → {os.path.basename(pdf_file)}')
def convert_word_in_folder(input_dir, output_dir):
'''
批量转换文件夹内所有Word文档
input_dir: 包含Word文件的目录
output_dir: PDF输出目录
'''
if not os.path.exists(input_dir):
print(f'❌ 输入目录不存在:{input_dir}')
return
files = os.listdir(input_dir)
# 不区分大小写过滤 .doc 和 .docx
word_files = [f for f in files if f.lower().endswith((".doc", ".docx"))]
if not word_files:
print('❌ 未找到任何Word文档(.doc 或 .docx)')
return
os.makedirs(output_dir, exist_ok=True)
print(f'📂 找到 {len(word_files)} 个Word文件,开始转换...')
for word_file in word_files:
full_input = os.path.join(input_dir, word_file)
base_name = os.path.splitext(word_file)[0] + ".pdf"
full_output = os.path.join(output_dir, base_name)
# 跳过已存在的PDF(避免重复转换)
if os.path.exists(full_output):
print(f'⏭️ 已跳过(文件已存在):{base_name}')
continue
try:
doc2pdf(full_input, full_output)
except Exception as e:
print(f'❌ 转换 {word_file} 时出错:{e}')
print('🎉 所有Word文档转换完成!')
if __name__ == "__main__":
# ---------- 全部使用动态路径 ----------
script_dir = os.path.dirname(os.path.abspath(__file__))
# 输入目录:默认使用脚本所在目录(把你的Word文档放这里)
docpath = script_dir
# 输出目录:在脚本所在目录下新建 'pdf_output' 文件夹
pdfpath = os.path.join(script_dir, 'pdf_output')
convert_word_in_folder(docpath, pdfpath)代码逐段精讲
动态路径——用完即走,无需配置
script_dir = os.path.dirname(os.path.abspath(__file__)) docpath = script_dir pdfpath = os.path.join(script_dir, 'pdf_output')
还是老规矩,脚本在哪,它就在哪工作。输出的 PDF 统一放在 pdf_output 子文件夹,干净整洁。
核心转换函数ExportAsFixedFormat
doc.ExportAsFixedFormat(pdf_file,
constants.wdExportFormatPDF,
Item=constants.wdExportDocumentWithMarkup,
CreateBookmarks=constants.wdExportCreateHeadingBookmarks)这是 Word 自带的导出方法,参数含义:
wdExportFormatPDF:输出 PDF 格式(值=17)Item=wdExportDocumentWithMarkup:导出包含批注的文档(可改为wdExportDocumentContent只导正文)CreateBookmarks=wdExportCreateHeadingBookmarks:为标题自动生成书签(PDF 左侧导航栏)
你甚至可以改为 constants.wdExportFormatXPS 输出 XPS 格式,灵活多变。
跳过已存在的 PDF
if os.path.exists(full_output):
print(f'⏭️ 已跳过(文件已存在):{base_name}')
continue如果中途运行中断,再次执行时不会重复转换,省时省力。
避坑指南
ImportError: No module named win32com.client
原因:pywin32 未安装或安装不完整。
解决方案:重新安装:
pip install --upgrade pywin32 -i https://mirrors.aliyun.com/pypi/simple/
然后重启 Python 环境。
总结
通过不到 60 行 Python 代码,我们利用系统自带的 Microsoft Word 实现了 Word 批量转 PDF。它:
- 完美保留原文档格式(字体、段落、表格、图片)
- 自动生成书签,方便 PDF 导航
- 动态路径,随放随用
- 支持
.doc和.docx双格式
至此,我们完成了 办公自动化文档转换三部曲:
- PDF → 图片(PyMuPDF)
- PPT → PDF(comtypes)
- Word → PDF(pywin32)
三篇文章相辅相成,覆盖了日常办公最常用的文档格式转换需求。赶紧收藏备用吧!
到此这篇关于Python办公自动化之调用Word实现批量DOC转PDF并保留原格式的文章就介绍到这了,更多相关Python Word批量转PDF内容请搜索脚本之家以前的文章或继续浏览下面的相关文章希望大家以后多多支持脚本之家!
