前言

更多内容,请访问我的 个人博客。


前言

全网找了一番,用python创建和更新word(.docx)文档,还是 python-docx 包比较好用。

依赖

  • Python 2.6, 2.7, 3.3, or 3.4
  • lxml >= 2.3.2

安装模块

  • 由于 python-docx 已经提交给 PyPI 仓库,所以可以使用 pip 安装,如下: pip install python-docx
  • 如果同时安装了 python2python3 那么 pip 可能不能用,可以使用 pip3 来安装,如下: pip3 install python-docx
  • python-docx 也可以使用 easy_install 来安装,如下:easy_install python-docx
  • 如果不能使用 pipeasy_install ,可以在 PyPI 下载包、解压、运行 setup.py ,如下: tar xvzf python-docx-{version}.tar.gz cd python-docx-{version} python setup.py install python-docx 还依赖 lxml 包 ,使用前2种方法会自动安装所需依赖包,第三种方法需要自己手动安装。

处理word文档

新建文档类

首先新建一个空白文档类 Document ,如下:

from docx import Documentdocument = Document()

编辑已存在的word文档

python-docx 不仅可以创建word文档,还可以编辑已存在的word文档。
其实吧,这玩意儿只能编辑已存在的word文档,之所以有个“创建空白文档”的功能,只不过是拷贝一份空白word文档到工作区间,再在空白文档上编辑,看起来似乎是“创建空白文档”罢了。本质上还是编辑已存在的word文档,捂脸中...
打开一个word文档,编辑完后,一定要记得保存。如果保存文件名和原文件名不一样,则会另存为一份word文档;若文件名一样,则会不加提示的保存修改内容。如下:

from docx import Documentdocument = Document('existing-document-file.docx')
document.save('new-file-name.docx')

新增段落

在word中 段落 是最常见的,创建段落 paragraph 的操作如下:

paragraph = document.add_paragraph('这是个段落。')

在此段落之前插入一个段落,如下:

prior_paragraph = paragraph.insert_paragraph_before('这是前面的段落。')

新增标题

新增标题代码如下:

document.add_heading('这是个标题')

修改标题大小,有1-9种规格,如下:

document.add_heading('The role of dolphins', level=2)

如果使用 level=0 ,则会新增一个带有下划线样式的标题。

新增分页符

代码如下:

document.add_page_break()

新增表格

创建一个2行2列的表格 Table,如下:

table = document.add_table(rows=2, cols=2)

获取第一行第二列的单元格类,如下:

cell = table.cell(0, 1)

写入数据,如下:

cell.text = '这是第一行第二列的单元格'

不仅如此,还能以数组的形式获取整个行或列,如下:

row = table.rows[1]
row.cells[0].text = '第二行第一列'
row.cells[1].text = '第二行第二列'

或循环操作,如下:

for row in table.rows:for cell in row.cells:print(cell.text)

len() 方法获取行数或列数,如下:

row_count = len(table.rows)
col_count = len(table.columns)

增加行,如下:

row = table.add_row()

设置表格样式,如下:

table.style = 'LightShading-Accent1'

插入图片

插入本地图片,如下:

document.add_picture('demo.png')

默认情况下,图片大小往往不尽如人意,调整图片大小,如下:

from docx.shared import Inchesdocument.add_picture('demo.png', width=Inches(1.0), height=Inches(1.0))

若同时定义宽度和高度,则图片会被拉伸或压缩到指定大小;若仅定义宽度或高度,则图会自适应调整大小。所以,建议仅定义宽度即可。

段落操作

设置段落样式

设置段落样式,如下:

document.add_paragraph('这是一个样式为 ListBullet 的段落', style='ListBullet')

paragraph = document.add_paragraph('这是一个样式为 ListBullet 的段落')
paragraph.style = 'List Bullet'

设置段落对齐方式

段落对齐方式有 左对齐文字居中右对齐文本两端对齐等,更多对齐方式请移步 WD_ALIGN_PARAGRAPH

from docx.enum.text import WD_ALIGN_PARAGRAPH# LEFT      =>  左对齐
# CENTER    =>  文字居中
# RIGHT     =>  右对齐
# JUSTIFY   =>  文本两端对齐paragraph = document.add_paragraph("你说啥")
paragraph_format = paragraph.paragraph_format
paragraph_format.alignment = WD_ALIGN_PARAGRAPH.CENTER

设置段落缩进

设置段落缩进,可为负值,如下:

from docx.shared import Inchesparagraph = document.add_paragraph("你说啥")
paragraph_format = paragraph.paragraph_format
paragraph_format.left_indent = Inches(0.5)

也可以设置首行缩进,如下:

paragraph_format.first_line_indent = Inches(-0.25)

设置段落制表符

详情请移步 TabStops

设置段落间距

分为 段前段后 ,设置值用 Pt 单位是 ,如下:

paragraph_format.space_before = Pt(18)
paragraph_format.space_after = Pt(12)

设置段落行距

当行距为 最小值固定值 时,设置值单位为 ,需要用 Pt ;当行距为 多倍行距 时,设置值为数值,如下:

from docx.shared import Length#SINGLE         =>  单倍行距(默认)
#ONE_POINT_FIVE =>  1.5倍行距
#DOUBLE2        =>  倍行距
#AT_LEAST       =>  最小值
#EXACTLY        =>  固定值
#MULTIPLE       =>  多倍行距paragraph.line_spacing_rule = WD_LINE_SPACING.EXACTLY #固定值
paragraph_format.line_spacing = Pt(18) # 固定值18磅
paragraph.line_spacing_rule = WD_LINE_SPACING.MULTIPLE #多倍行距
paragraph_format.line_spacing = 1.75 # 1.75倍行间距

设置段落分页

  • 孤行控制
    防止在页面顶端单独打印段落末行或在页面底端单独打印段落首行。
  • 与下段同页
    防止在选中段落与后面一段间插入分页符。
  • 段中不分页
    防止在段落中出现分页符。
  • 段前分页
    在选中段落前插入分页符。
#widow_control      =>  孤行控制
#keep_with_next     =>  与下段同页
#page_break_before  =>  段前分页
#keep_together      =>  段中不分页paragraph_format.keep_with_next = True

字体操作

设置粗体和斜体

在设置粗体和斜体之前,我们先简单了解一下 段落 里的运行机制。段落包含很多块级的格式,比如缩进、行高、制表符等。每一个小片段叫做一个 run ,可以对 run 设置粗体和斜体等属性。
我们可以设置如下:

paragraph = document.add_paragraph()
paragraph.add_run('这是一个带有')
paragraph.add_run('粗体').bold = True
paragraph.add_run('和')
paragraph.add_run('斜体').italic = True
paragraph.add_run('的段落。')

设置字体属性

run 设置字体、大小、颜色下划线等,更多属性请移步 Font ,如下:

from docx.shared import RGBColor,Pt#all_caps       =>  全部大写字母
#bold           =>  加粗
#color          =>  字体颜色
#complex_script =>  是否为“复杂代码”
#cs_bold        =>  “复杂代码”加粗
#cs_italic      =>  “复杂代码”斜体
#double_strike  =>  双删除线
#emboss         =>  文本以凸出页面的方式出现
#hidden         =>  隐藏
#imprint        =>  印记
#italic         =>  斜体
#name           =>  字体
#no_proof       =>  不验证语法错误
#outline        =>  显示字符的轮廓
#shadow         =>  阴影
#small_caps     =>  小型大写字母
#snap_to_grid   =>  定义文档网格时对齐网络
#strike         =>  删除线
#subscript      =>  下标
#superscript    =>  上标
#underline      =>  下划线paragraph = document.add_paragraph()
paragraph.add_run('这是一个带有')
paragraph.add_run('颜色').font.color.rgb = RGBColor(54, 95, 145)
paragraph.add_run('的')
paragraph.add_run('大字').font.size = Pt(36)  # 字体大小设置,和word里面的字号相对应

设置字符样式

除了设置段落样式外,还可以设置一组字符样式,比如字体、大小、颜色、粗体、斜体等,如下:

# 自定义样式 Emphasisparagraph = document.add_paragraph('这是一个带有')
paragraph.add_run('自定义样式', 'Emphasis')
paragraph.add_run('的段落')

paragraph = document.add_paragraph('这是一个带有 ')
run = paragraph.add_run('自定义样式')
run.style = 'Emphasis'
paragraph.add_run('的段落')

页眉和页脚

更多内容请移步 Working with Headers and Footers

枚举的文档

  • MSO_COLOR_TYPE
  • MSO_THEME_COLOR_INDEX
  • WD_PARAGRAPH_ALIGNMENT
  • WD_BUILTIN_STYLE
  • WD_CELL_VERTICAL_ALIGNMENT
  • WD_COLOR_INDEX
  • WD_LINE_SPACING
  • WD_ORIENTATION
  • WD_TABLE_ALIGNMENT
  • WD_ROW_HEIGHT_RULE
  • WD_SECTION_START
  • WD_STYLE_TYPE
  • WD_TAB_ALIGNMENT
  • WD_TAB_LEADER
  • WD_TABLE_DIRECTION
  • WD_UNDERLINE

名称解释

官网解释


更多编程教学请关注公众号:潘高陪你学编程


c# word 增加段落_python-docx处理word文档相关推荐

  1. c# word 增加段落_常用的word快捷键命令大全 办公必须掌握的word技能→MAIGOO知识...

    Word最常用的通用快捷键 1.基础功能快捷键 Ctrl+B:加粗 Ctrl+I:斜体 Ctrl+U:为字符添加下划线 Ctrl+Shift+<:缩小字号 Ctrl+Shift+>:增大字 ...

  2. 微软 Office Online 在线查看word,pdf, xls,ppt 文档

    使用微软提供的Office Online平台只需要一个网址即可在线查看Xls,doc,PPT等文档 http://view.officeapps.live.com/op/view.aspx?src=要 ...

  3. 信创办公--基于WPS的Word最佳实践系列(快速统一文档格式)

    信创办公–基于WPS的Word最佳实践系列(快速统一文档格式) 项目背景 在一篇长文档中,会存在标题和正文的部分,而作为标题,就应该具有和正文有所区分的特殊格式.如果要一个一个标题进行设置,里面的重复 ...

  4. 比Word更优雅的记笔记/写文档/交报告方式

    比Word更优雅的记笔记/写文档/交报告方式 markdown+vscode->pdf 背景 最近在上的一门<信息系统开发工具>课老师要求实验以后都要交实验报告,但是和以往不同的是, ...

  5. 怎么批量删除 Word、PDF、PPT 以及 Excel 文档中的空白页?

    概要:「我的ABC软件工具箱」提供了删除空白页的功能,轻轻松松就可以实现批量删除文档中的空白页.目前支持 Word.PDF.PPT 以及 Excel 等格式文件文件.操作非常的方便,处理也非常高效! ...

  6. 微信公众号怎么添加Word、Excel、PPT、PDF文档下载链接?

    因为公司业务的增长,公司着急需要招聘几个新人到新开的业务线,火线上岗.考虑到公司公众号运营多年,有一定的用户基础,所以HR小姐姐在征求了老板的意见后,决定在公众号发表一篇招聘文.在征求了几个部门的用人 ...

  7. word 2010打不开03格式文档解决办法

    word 2010打不开03格式文档解决办法,右键属性,点击提示框下部"解除锁定",确认后,再双击文件就能打开了.

  8. python删除word表格中的某一行_python docx删除word段落

    使用python-docx编辑一个docx文档时, 对添加的方法使用很多, 但有时候也会用到删除和修改 python-docx中并没有提供delete()方法, github上给出了解决方法: htt ...

  9. c# word 增加段落_Word 行间距怎么设置,空格、字号、公式导致行距不一样等设置...

    在 Word 中,行距也称行间距,为便于阅读需要把文字设置为合适的行间距.行间距怎么设置?行间距设置通常有三种方法,分别为用常规行间距选项设置.在"段落"窗口设置和用快捷键设置. ...

  10. c# word 增加段落_Word排版费时又费力?用上这款插件,再冗杂的内容也能轻松排好...

    Hi,我是秋小叶~ Office 插件的出现就像是给 Office 三件套插上了翅膀,有很多手工复杂的操作,因为有了插件,瞬间把我们从繁杂的工作中解放了出来! 你可能已经熟悉PPT 的NT插件.OK插 ...

最新文章

  1. 函数实现十进制转二进制
  2. HTML5中是否有浮点输入类型?
  3. Spring Boot 2.x多线程--使用@Async开启多线程使用示例
  4. 【转载】用JS控制输入内容
  5. 今天学了瀑布流的js方法
  6. 麒麟linux创建用户组,麒麟Linux系统用户和组管理指南(21页)-原创力文档
  7. C++ 类成员引用变量的使用
  8. 4.2-户部告急-百姓们太太太太太能生了2333
  9. java string做除法_如果用java来实现传统方式的除法,用String来保存结果,想精确多少位都行,那改怎么做?...
  10. 第三节:SpringBoot中web项目推荐目录结构
  11. java零基础Ⅲ-- 8.算法优化体验课-骑士周游问题
  12. 确定你的电脑是否支持安装64位操作系统
  13. 太阳能计算机屏幕是什么材质,电脑显示器表面是什么材质的 什么是液晶玻璃...
  14. Windows:在Windows下创建并删除软连接
  15. 推荐3个干净、资源多的看剧网站给大家
  16. CIO40:家电巨头数字化运营历程(IT-DT-OT)
  17. xshell报错-要继续使用此程序,您必须应用最新的更新或使用新版本
  18. about oracle
  19. ffmpeg混音(混声)命令
  20. 关于scrapy shell 在ipython环境下 TAB出现debug信息解决方案

热门文章

  1. Mac 10.14 编译Android 8.1源码及刷入nexus 6p
  2. 什么是jsp,对于jsp的详细理解
  3. 破解mxp swc 破解的方法
  4. 2021年茶艺师(高级)考试资料及茶艺师(高级)考试试卷
  5. 计算机设计大赛心得总结-软件开发组
  6. Python元组类型详解
  7. 浙江工大学计算机学院院长,浙江省计算机系主任(院长)论坛会议
  8. 2021年茶艺师(中级)考试报名及茶艺师(中级)复审考试
  9. python小数乘法计算_多种思维理解小数的乘法运算
  10. 多线程的三种实现方法、线程类的常见方法、线程安全问题:synchronized和Lock锁、生产者和消费者问题