在平时的工作中,难免需要一些 小Tip 来解决工作中遇到的问题,今天的文章给大家安利一个方便快捷的小技巧,将 Office(doc/docx/ppt/pptx/xls/xlsx)文件批量或者单一文件转换为 PDF 文件。 不过在做具体操作之前需要在 PC 安装好 Office,再利用 Python 的 win32com 包来实现 Office 文件的转换操作。

安装 win32com

在实战之前,需要安装 Python 的 win32com,详细安装步骤如下:

使用 pip 命令安装

pip install pywin32

如果我们遇到安装错误,可以通过python -m pip install –upgrade pip更新云端的方式再进行安装即可:

python -m pip install --upgrade pip

下载离线安装包安装

如果 pip 命令未安装成功的话还可以下载离线包安装,方法步骤如下: 首先在官网选择对应的 Python 版本下载离线包:https://sourceforge.net/projects/pywin32/files/pywin32/Build%20221/ 下载好后傻瓜式安装好即可。

文件转换逻辑

详细代码如下:

class PDFConverter:

def __init__(self, pathname, export='.'):

self._handle_postfix = ['doc', 'docx', 'ppt', 'pptx', 'xls', 'xlsx'] # 支持转换的文件类型

self._filename_list = list() #列出文件

self._export_folder = os.path.join(os.path.abspath('.'), 'file_server/pdfconver')

if not os.path.exists(self._export_folder):

os.mkdir(self._export_folder)

self._enumerate_filename(pathname)

def _enumerate_filename(self, pathname):

'''

读取所有文件名

'''

full_pathname = os.path.abspath(pathname)

if os.path.isfile(full_pathname):

if self._is_legal_postfix(full_pathname):

self._filename_list.append(full_pathname)

else:

raise TypeError('文件 {} 后缀名不合法!仅支持如下文件类型:{}。'.format(pathname, '、'.join(self._handle_postfix)))

elif os.path.isdir(full_pathname):

for relpath, _, files in os.walk(full_pathname):

for name in files:

filename = os.path.join(full_pathname, relpath, name)

if self._is_legal_postfix(filename):

self._filename_list.append(os.path.join(filename))

else:

raise TypeError('文件/文件夹 {} 不存在或不合法!'.format(pathname))

def _is_legal_postfix(self, filename):

return filename.split('.')[-1].lower() in self._handle_postfix and not os.path.basename(filename).startswith(

'~')

def run_conver(self):

print('需要转换的文件数是:', len(self._filename_list))

for filename in self._filename_list:

postfix = filename.split('.')[-1].lower()

funcCall = getattr(self, postfix)

print('原文件:', filename)

funcCall(filename)

print('转换完成!')

doc/docx 转换为 PDF

doc/docx 转换为 PDF 部分代码如下所示:

def doc(self, filename):

name = os.path.basename(filename).split('.')[0] + '.pdf'

exportfile = os.path.join(self._export_folder, name)

print('保存 PDF 文件:', exportfile)

gencache.EnsureModule('{00020905-0000-0000-C000-000000000046}', 0, 8, 4)

pythoncom.CoInitialize()

w = Dispatch("Word.Application")

pythoncom.CoInitialize() # 加上防止 CoInitialize 未加载

doc = w.Documents.Open(filename)

doc.ExportAsFixedFormat(exportfile, constants.wdExportFormatPDF,

Item=constants.wdExportDocumentWithMarkup,

CreateBookmarks=constants.wdExportCreateHeadingBookmarks)

w.Quit(constants.wdDoNotSaveChanges)

def docx(self, filename):

self.doc(filename)

ppt/pptx 转换为 PDF

ppt/pptx 转换为 PDF 部分代码如下:

def ppt(self, filename):

name = os.path.basename(filename).split('.')[0] + '.pdf'

exportfile = os.path.join(self._export_folder, name)

gencache.EnsureModule('{00020905-0000-0000-C000-000000000046}', 0, 8, 4)

pythoncom.CoInitialize()

p = Dispatch("PowerPoint.Application")

pythoncom.CoInitialize()

ppt = p.Presentations.Open(filename, False, False, False)

ppt.ExportAsFixedFormat(exportfile, 2, PrintRange=None)

print('保存 PDF 文件:', exportfile)

p.Quit()

def pptx(self, filename):

self.ppt(filename)

xls/xlsx 转换为 PDF

def xls(self, filename):

name = os.path.basename(filename).split('.')[0] + '.pdf'

exportfile = os.path.join(self._export_folder, name)

pythoncom.CoInitialize()

xlApp = DispatchEx("Excel.Application")

pythoncom.CoInitialize()

xlApp.Visible = False

xlApp.DisplayAlerts = 0

books = xlApp.Workbooks.Open(filename, False)

books.ExportAsFixedFormat(0, exportfile)

books.Close(False)

print('保存 PDF 文件:', exportfile)

xlApp.Quit()

def xlsx(self, filename):

self.xls(filename)

执行逻辑转换

if __name__ == "__main__":

# 支持文件夹批量导入

#folder = 'tmp'

#pathname = os.path.join(os.path.abspath('.'), folder)

# 也支持单个文件的转换

pathname = "G:/python_study/test.doc"

pdfConverter = PDFConverter(pathname)

pdfConverter.run_conver()

总结

今天的文章主要是 Python 实战之小工具的运用,希望对大家有所帮助,下一期将讲解如何通过接口的方式通过文件服务器来下载文件并转换,敬请期待。。。 So 今天的小 Tip 你安利到了吗?

示例代码

以上就是python 如何将office文件转换为PDF的详细内容,更多关于python Office 文件转 PDF的资料请关注脚本之家其它相关文章!

python office转pdf_python 如何将office文件转换为PDF相关推荐

  1. Word处理控件Aspose.Words功能演示:在 Python 中将 TXT 文件转换为 PDF

    各种人使用记事本以TXT格式记下重点或快速创建笔记.此外,TXT 文件用于在各种应用程序中存储纯文本.但是,由于记事本不提供高级功能,因此 TXT 文件通常会转换为PDF.为了以编程方式自动将 TXT ...

  2. python office转pdf linux_python 如何将office文件转换为PDF

    在平时的工作中,难免需要一些 小Tip 来解决工作中遇到的问题,今天的文章给大家安利一个方便快捷的小技巧,将 Office(doc/docx/ppt/pptx/xls/xlsx)文件批量或者单一文件转 ...

  3. Office文档上传后实时转换为PDF格式_图片文件上传后实时裁剪_实现在线预览Office文档

    Office文档上传后实时转换为PDF格式_图片文件上传后实时裁剪 前置条件 安装LibreOffice 安装OpenOffice 安装Unoconv 安装ImageMagick.x86_64 安装G ...

  4. office文件转换为pdf文件

    office文件转换为pdf文件 首先安装openoffice,自行百度 导入jar包,自行百度 引入坐标: <!-- 转pdf配置 --><dependency><gr ...

  5. python批量操作word文档实战_python批量实现Word文件转换为PDF文件

    本文为大家分享了python批量转换Word文件为PDF文件的具体方法,供大家参考,具体内容如下 1.目的 通过万能的Python把一个目录下的所有Word文件转换为PDF文件. 2.遍历目录 作者总 ...

  6. python批量pdf转word,python批量实现Word文件转换为PDF文件

    本文为大家分享了python批量转换Word文件为PDF文件的具体方法,供大家参考,具体内容如下 1.目的 通过万能的Python把一个目录下的所有Word文件转换为PDF文件. 2.遍历目录 作者总 ...

  7. 想在Python中将Excel文件转换为PDF?来看看这份Aspose.Cells指南

    如今,PDF已成为交换文档的标准文件格式.在互联网上共享各种流行的文档格式之前,先将它们转换为PDF.Excel到PDF是将工作表转换为只读PDF页面的一种流行的转换方案.因此,本文介绍了如何使用Py ...

  8. 使用Jacob实现将Word文件转换为Pdf文件

    在某些业务场景下,可能需要将Word文件转换为Pdf文件的需求,Word文件编辑方便,而Pdf文件查看更方便,并且格式基本不会变化,同时可以避免被误编辑. 如果使用的是Java语言,那么可以借助于Ja ...

  9. 使用java程序将ceb文件转换为pdf文件

    要使用 Java 程序将 CEB 文件转换为 PDF 文件,你可以使用 Apache POI 库来读取 CEB 文件并解析其内容. Apache POI 是一个开源的 Java 库,可以用于读取和写入 ...

最新文章

  1. LeetCode 316. 去除重复字母 / 1081. 不同字符的最小子序列(单调栈)
  2. (转载)linux中编译安装log4cpp
  3. 如何更改html广告,js 动态改变广告代码DIV的位置_原生JS通过innerHTML改变div位置...
  4. 作为一位75后的职场宝妈
  5. oracle not in 改为 not exist
  6. 新申请了一个博客,这个博客主要用来记录编程学习笔记
  7. 《HiWind企业快速开发框架实战》(2)使用HiWind创建自己的项目
  8. CANoe 13 demo 下载和激活-转载
  9. 先验 超验_经验、先验、超验
  10. 前端学习图谱与新奇趣玩之前端Q直播回顾
  11. 一篇讲透图表操作:趋势类比较类占比类分布类图表
  12. python爬虫代码大作业_爬虫大作业
  13. CTFshow-萌新
  14. ie浏览器java不弹窗_解决IE屏蔽Java Applet问题的方法 .
  15. Q1财报大超预期,“大象”百度成功“转身”?
  16. IT从业者的职业规划
  17. VDI虚拟桌面基础架构
  18. CISSP 第十一章 安全运营
  19. 程序员不一定要进大厂,但是算法一定要学
  20. Style Transfer(PyTorch)

热门文章

  1. 5h是什么意思_2B铅笔中的2B是啥意思?
  2. android intent 跳转activity,Activity 跳转 都知道用startActivity(Intent)
  3. 吴恩达机器学习【第六天】神经网络模型
  4. ZooKeeper(四)ZooKeeper的简单使用
  5. 基于ConvLSTM的伦敦空气质量预测(1) 数据处理
  6. 瞬时极性法对正负反馈的判断方法_何为反馈?如何判断?统统告诉你
  7. thinkcmf 横向排列数据_Excel横向筛选出销量靠后的月份数据,你知道如何实现吗...
  8. .net winform panel 不刷新_winform项目——仿QQ即时通讯程序04:登录界面补充
  9. 最新战火互娱JS逆向分析实战教程
  10. 跨域解决方案CROS最简单演示——JSP演示示例