Python能够快速的编写、调试,用来提取各类软件中的图片再好不过了。今天小编就为大家带来在Python中提取Word图片的方法。

方法

需要批量的修改文件后缀名,并且解压之后将图片拷贝到需要存放的地方,然后将该文件夹清空留作下次的路径,并且将文件从zip改回docx即可。(注意:doc不支持这个方法,如果需要提取doc格式的图片,可以先转为docx,再提取即可)

具体实现

1.导入相关库

'''

===========================================

@author:  renjiaxin

@time:    2018/8/9 0009   10:00

===========================================

'''

import zipfile

import os

import shutil

2.定义函数

为了方便和其他函数调用,直接写了个函数完成这个功能,在这里,我们需要以下四个参数:word文档的路径

zip压缩文件的路径

临时解压的tmp路径

最后需要保存的store_path路径

def word2pic(path, zip_path, tmp_path, store_path):

'''

:param path:源文件

:param zip_path:docx重命名为zip

:param tmp_path:中转图片文件夹

:param store_path:最后保存结果的文件夹(需要手动创建)

:return:

'''

3.重命名word文件,将后缀名docx改为zip

# 将docx文件重命名为zip文件

os.rename(path, zip_path)

# 进行解压

f = zipfile.ZipFile(zip_path, 'r')

# 将图片提取并保存

for file in f.namelist():

f.extract(file, tmp_path)

# 释放该zip文件

f.close()

4.zip还原为docx文件,并获得图片的列表

# 将docx文件从zip还原为docx

os.rename(zip_path, path)

# 得到缓存文件夹中图片列表

pic = os.listdir(os.path.join(tmp_path, 'word/media'))

5.将图片复制到需要保存的文件夹中

并且我们将文件的名字命名为word所在的路径

# 将图片复制到最终的文件夹中

for  i  in  pic:

# 根据word的路径生成图片的名称

new_name = path.replace('\\', '_')

new_name = new_name.replace(':', '') '_' i

shutil.copy(os.path.join(tmp_path '/word/media', i), os.path.join(store_path, new_name))

6.删除tmp缓冲文件夹中的文件,用以存储下一次的文件

# 删除缓冲文件夹中的文件,用以存储下一次的文件

for i in os.listdir(tmp_path):

# 如果是文件夹则删除

if os.path.isdir(os.path.join(tmp_path, i)):

shutil.rmtree(os.path.join(tmp_path, i))

7.运行程序

if __name__ == '__main__':

# 源文件

path = r'E:\dogcat\提取图片\log.docx'

# docx重命名为zip

zip_path = r'E:\dogcat\提取图片\log.zip'

# 中转图片文件夹

tmp_path = r'E:\dogcat\提取图片\tmp'

# 最后保存结果的文件夹

store_path = r'E:\dogcat\提取图片\测试'

m = word2pic(path, zip_path, tmp_path, store_path)

效果预览

源word

提取的图片

另附doc转docx

def doc2docx(doc_name, docx_name):

'''

# doc转docx

:param doc_name: doc文档路径

:param docx_name: docx文档路径

:return:

'''

try:

# 首先将doc转换成docx

word = client.Dispatch("Word.Application")

doc = word.Documents.Open(doc_name)

# 使用参数16表示将doc转换成docx

doc.SaveAs(docx_name, 16)

doc.Close()

word.Quit()

except:

pass

今天Python提取Word中图片的方法全部分享给大家啦,后面还有提取excel和pdf图片的方法,敬请期待。更多Python学习推荐:JQ教程网Python大全。

python读取word图片_Python中如何读取Word中的图片相关推荐

  1. python读取csv文件_python配置文件的读取

    本文主要分享下python中如何读取配置文件 1. 首先我们要了解什么是配置文件? 2. 配置文件就是项目使用的常量,我们把它们放在一个文件里面,一般以.ini..conf..xml..yaml等结尾 ...

  2. python批量读取文件内容_Python之批量读取文件【面试必学】

    原博文 2019-12-24 14:00 − python的os模块可以实现普遍的操作系统功能,并且和平台无关.以下为实现根目录下文件的批量读取. os.listdir(dirname)可以列出dir ...

  3. python调用usb摄像头_Python通过cv2读取多个USB摄像头

    本文实例为大家分享了Python通过cv2读取多个USB摄像头的具体代码,供大家参考,具体内容如下 通过 cv2 可以轻易的拿到摄像头数据. 比如以下几步就能打开摄像头显示,并通过 q 键保存图片 i ...

  4. python docx 提取图片_Python提取docx文档中所有嵌入式图片和浮动图片

    术语: 浮动图片,是指在Word文档中位置可以自由移动.可以环绕文字或放置于文字上方.下方的图片,不占文档流的位置,可以和文字或嵌入式图片重叠. 嵌入式图片或行内图片,和文档中的文字一样占文档流的位置 ...

  5. python 手机自动化操作_Python自动化办公之word操作

    Python自动化办公之word操作,主要是用到python-docx库,针对word操作,对大批量重复性工作,使用python可以节省大量的时间和经历 python-docx word文档中的文字有 ...

  6. python写word下标_Python用python-docx读写word文档

    备注: doc是微软的专有的文件格式,docx是Microsoft Office2007之后版本使用,其基于Office Open XML标准的压缩文件格式,比 doc文件所占用空间更小.docx格式 ...

  7. python 数据框缺失值_Python:处理数据框中的缺失值

    python 数据框缺失值 介绍 (Introduction) In the last article we went through on how to find the missing value ...

  8. 如何利用python自动化办公项目_python办公自动化:自动进行word文档处理和排版

    上节python办公自动化:自动打开word文档我们一起学会了在python里打开并保存一个word文档.这节我们将会学会如何利用python进行文本处理和将其在word里进行排版等技巧. pytho ...

  9. python千人成像_Python实现千图成像:从图片爬取到图片合成

    千图成像:用N张图片拼凑成一张图片. 实现原理:先将所要成像的图片转化成马赛克图片,然后从图库中用对应颜色的图片替换相应色块. 图库中的图片处理:标记图库中每张图片的混合颜色,用于替换目标色块,并记录 ...

  10. python word排版_python办公自动化:自动进行word文档处理和排版-docx文件

    上节python办公自动化:自动打开word文档我们一起学会了在python里打开并保存一个word文档.这节我们将会学会如何利用python进行文本处理和将其在word里进行排版等技巧. pytho ...

最新文章

  1. 对ARM异常(Exceptions)的理解
  2. node.js项目应用
  3. onvif linux
  4. Sublime Text2,跨平台神级编辑器乱码问题解决
  5. ftp服务器搭建遇到的问题
  6. python指定文件路径_python实现指定文件夹下的指定文件移动到指定位置
  7. 使用Servlet实现用户注册
  8. 计算机论文的的格式,计算机论文格式模板.doc
  9. dell4600服务器不能启动
  10. 查询和预测影响因子,这篇文章就够了
  11. Structs2文件上传以及预览
  12. SEO为什么一定要面面俱到?
  13. IT招聘网站(程序员跳槽指南)
  14. 测试ios软件开发,iOS开发中的测试框架
  15. 微信小程序获取今日天气预报api 免费接口
  16. 【算法导论-主定理】用主方法求解递归式 学练结合版
  17. Java架构师之旅(二十九 附录《MyBatis3 用户指南》中文版)
  18. MySQL语句—DDL语句
  19. 掘金mysql_我的 mysql 半年小得 | 掘金征文
  20. 编译Linux 内核

热门文章

  1. 网络演算(Networkcalculus)
  2. python websocket异步高并发_高并发异步uwsgi+web.py+gevent
  3. java矩阵连乘算法_使用java写的矩阵乘法实例(Strassen算法)
  4. oracle回滚事务的关键字,Oracle ROLLBACK语句(回滚事务)
  5. 《计算机网络自顶向下》之重头戏迪杰斯特拉算法
  6. xss 全编码两次_XSS进阶
  7. ldconfig mysql_ldconfig命令介绍
  8. 【chromium】 Chromium OS的oom机制
  9. 网络操作系统第242页作业
  10. Debug method