python实现word 2007文档转换为pdf文件

作者:网海水手 时间:2021-05-27 20:57:54 

在开发过程中,会遇到在命令行下将DOC文档(或者是其他Office文档)转换为PDF的要求。比如在项目中如果手册是DOC格式的,在项目发布时希望将其转换为PDF格式,并且保留DOC中的书签,链接等。将该过程整合到构建过程中就要求命令行下进行转换。

Michael Suodenjoki展示了使用Office的COM接口进行命令行下的转换。但其导出的PDF文档没有书签。在Office 2007 SP2中,微软加入了该功能,对应的接口是ExportAsFixedFormat。该方法不仅适用于Word,而且也适用于Excel。

一个简单的Python脚本来展示如何转换DOC为PDF。该脚本需要Office 2007 SP2, Python 2.6与Python for win32(使Python能调用COM)。这里也可以使用其他支持COM的语言。ExportAsFixedFormat还有其他一些参数,具体参见MSDN相关文档。需要注意的是文档路径需要为绝对路径,因为Word启动后当前路径不是调用脚本时的当前路径。


#-*- coding:utf-8 -*-

# doc2pdf.py: python script to convert doc to pdf with bookmarks!
# Requires Office 2007 SP2
# Requires python for win32 extension

import sys, os
from win32com.client import Dispatch, constants, gencache

def doc2pdf(input, output):
w = Dispatch("Word.Application")

try:
 doc = w.Documents.Open(input, ReadOnly = 1)
 doc.ExportAsFixedFormat(output, constants.wdExportFormatPDF,  
  Item = constants.wdExportDocumentWithMarkup, CreateBookmarks = constants.wdExportCreateHeadingBookmarks)
 return 0
except:
 return 1
finally:
 w.Quit(constants.wdDoNotSaveChanges)

# Generate all the support we can.
def GenerateSupport():
# enable python COM support for Word 2007
# this is generated by: makepy.py -i "Microsoft Word 12.0 Object Library"
gencache.EnsureModule('{00020905-0000-0000-C000-000000000046}', 0, 8, 4)

def main():
if (len(sys.argv) == 2):
 input = sys.argv[1]
 output = os.path.splitext(input)[0]+'.pdf'
elif (len(sys.argv) == 3):
 input = sys.argv[1]
 output = sys.argv[2]
else:
 input = u'BA06007013.docx'#word文档的名称
 output = u'BA06007013.pdf'#pdf文档的名称
if (not os.path.isabs(input)):
 input = os.path.abspath(input)
if (not os.path.isabs(output)):
 output = os.path.abspath(output)
try:
 GenerateSupport()
 rc = doc2pdf(input, output)
 return rc
except:
 return -1

if __name__=='__main__':
 rc = main()
 if rc:
   sys.exit(rc)
 sys.exit(0)

来源:http://blog.csdn.net/rumswell/article/details/7434302

标签:python,word,pdf
0
投稿

猜你喜欢

  • Python实现实时跟随微信窗口移动的GUI界面

    2022-06-09 11:12:25
  • 详解Vue用cmd创建项目

    2024-05-21 10:16:38
  • python使用pygame框架实现推箱子游戏

    2022-02-12 00:34:13
  • xml css htc 的综合运用

    2008-10-10 11:41:00
  • PHP的Laravel框架中使用消息队列queue及异步队列的方法

    2024-05-11 10:08:15
  • Python设计模式中的策略模式详解

    2023-09-03 09:26:26
  • url传递中文的解决方案

    2007-10-09 20:17:00
  • Python argparse中的action=store_true用法小结

    2023-07-31 22:35:02
  • Oracle 中文字段进行排序的sql语句

    2024-01-22 13:26:43
  • python读写删除复制文件操作方法详细实例总结

    2022-07-29 05:58:56
  • python数字类型和占位符详情

    2022-10-03 06:36:32
  • 详解CSS3中的属性选择符

    2008-04-24 14:30:00
  • 怎样写好commit message提高业务效率

    2023-09-20 06:06:40
  • pygame学习笔记(5):游戏精灵

    2021-10-13 18:29:56
  • Django中ORM找出内容不为空的数据实例

    2022-03-24 04:47:56
  • 详解python的异常捕获

    2023-05-27 11:24:03
  • 利用python爬取散文网的文章实例教程

    2023-06-17 10:40:18
  • python数字图像处理skimage读取显示与保存图片

    2023-07-28 17:33:00
  • python数组如何添加整行或整列

    2022-04-29 16:39:30
  • Django drf使用Django自带的用户系统的注册功能

    2023-07-15 00:21:38
  • asp之家 网络编程 m.aspxhome.com