python

关注公众号 jb51net

关闭
首页 > 脚本专栏 > python > Python Word批量转PDF

Python办公自动化之调用Word实现批量DOC转PDF并保留原格式

作者:Li Ming&

本文将教你用Python的pywin32库批量转换Word为PDF,完美保留原始排版和书签导航,支持doc和docx格式,代码动态路径即拿即用,让办公效率翻倍

前言

前面两篇文章我们分别实现了 PDF转图片 和 PPT转PDF,今天带来办公自动化三部曲的最后一环——Word批量转PDF。

你是否遇到过这些场景:

今天我就用 Python 的 pywin32(调用 Microsoft Word 的 COM 接口)来快速实现批量转换,不仅保留原始排版,连书签都能完美带过来。而且代码完全动态路径,放在任何文件夹都能直接运行。

左下角打开Python终端,使用阿里云镜像快速安装:

pip install pywin32 -i https://mirrors.aliyun.com/pypi/simple/

pywin32 是 Python 调用 Windows API 和 COM 组件的桥梁,我们通过它来控制 Word 应用程序。

完整代码

# -*- coding: utf-8 -*-

'''
Python批量将Word文件(DOC/DOCX)转为PDF文件
功能:自动识别当前目录下所有Word文档,调用本地Word转为PDF
'''
#pip install pywin32 -i https://mirrors.aliyun.com/pypi/simple/     安装包

import os   #导入内置系统的模块,用来遍历文件架里的所有文件。
from win32com.client import Dispatch, constants, gencache    #导入第三方软件库的工具


def doc2pdf(word_file, pdf_file):
    '''
    单个Word转PDF
    word_file: Word文件完整路径
    pdf_file: 输出PDF完整路径
    '''
    word = gencache.EnsureDispatch('Word.Application')
    doc = word.Documents.Open(word_file, ReadOnly=1)
    # 导出为PDF(关键参数)
    doc.ExportAsFixedFormat(pdf_file,
                            constants.wdExportFormatPDF,
                            Item=constants.wdExportDocumentWithMarkup,
                            CreateBookmarks=constants.wdExportCreateHeadingBookmarks)
    word.Quit(constants.wdDoNotSaveChanges)
    print(f'✅ 转换成功:{os.path.basename(word_file)} → {os.path.basename(pdf_file)}')


def convert_word_in_folder(input_dir, output_dir):
    '''
    批量转换文件夹内所有Word文档
    input_dir: 包含Word文件的目录
    output_dir: PDF输出目录
    '''
    if not os.path.exists(input_dir):
        print(f'❌ 输入目录不存在:{input_dir}')
        return

    files = os.listdir(input_dir)
    # 不区分大小写过滤 .doc 和 .docx
    word_files = [f for f in files if f.lower().endswith((".doc", ".docx"))]

    if not word_files:
        print('❌ 未找到任何Word文档(.doc 或 .docx)')
        return

    os.makedirs(output_dir, exist_ok=True)

    print(f'📂 找到 {len(word_files)} 个Word文件,开始转换...')
    for word_file in word_files:
        full_input = os.path.join(input_dir, word_file)
        base_name = os.path.splitext(word_file)[0] + ".pdf"
        full_output = os.path.join(output_dir, base_name)

        # 跳过已存在的PDF(避免重复转换)
        if os.path.exists(full_output):
            print(f'⏭️  已跳过(文件已存在):{base_name}')
            continue

        try:
            doc2pdf(full_input, full_output)
        except Exception as e:
            print(f'❌ 转换 {word_file} 时出错:{e}')
    print('🎉 所有Word文档转换完成!')


if __name__ == "__main__":
    # ---------- 全部使用动态路径 ----------
    script_dir = os.path.dirname(os.path.abspath(__file__))

    # 输入目录:默认使用脚本所在目录(把你的Word文档放这里)
    docpath = script_dir

    # 输出目录:在脚本所在目录下新建 'pdf_output' 文件夹
    pdfpath = os.path.join(script_dir, 'pdf_output')

    convert_word_in_folder(docpath, pdfpath)

代码逐段精讲

动态路径——用完即走,无需配置

script_dir = os.path.dirname(os.path.abspath(__file__))
docpath = script_dir
pdfpath = os.path.join(script_dir, 'pdf_output')

还是老规矩,脚本在哪,它就在哪工作。输出的 PDF 统一放在 pdf_output 子文件夹,干净整洁。

核心转换函数ExportAsFixedFormat

doc.ExportAsFixedFormat(pdf_file,
                        constants.wdExportFormatPDF,
                        Item=constants.wdExportDocumentWithMarkup,
                        CreateBookmarks=constants.wdExportCreateHeadingBookmarks)

这是 Word 自带的导出方法,参数含义:

你甚至可以改为 constants.wdExportFormatXPS 输出 XPS 格式,灵活多变。

跳过已存在的 PDF

if os.path.exists(full_output):
    print(f'⏭️  已跳过(文件已存在):{base_name}')
    continue

如果中途运行中断,再次执行时不会重复转换,省时省力。

避坑指南

ImportError: No module named win32com.client

原因pywin32 未安装或安装不完整。

解决方案:重新安装:

pip install --upgrade pywin32 -i https://mirrors.aliyun.com/pypi/simple/

然后重启 Python 环境

总结

通过不到 60 行 Python 代码,我们利用系统自带的 Microsoft Word 实现了 Word 批量转 PDF。它:

至此,我们完成了 办公自动化文档转换三部曲

三篇文章相辅相成,覆盖了日常办公最常用的文档格式转换需求。赶紧收藏备用吧!

到此这篇关于Python办公自动化之调用Word实现批量DOC转PDF并保留原格式的文章就介绍到这了,更多相关Python Word批量转PDF内容请搜索脚本之家以前的文章或继续浏览下面的相关文章希望大家以后多多支持脚本之家!

您可能感兴趣的文章:
阅读全文