Python读取word文本操作详解


Posted in Python onJanuary 22, 2018

本文研究的主要问题时Python读取word文本操作,分享了相关概念和实现代码,具体如下。

一,docx模块

Python可以利用python-docx模块处理word文档,处理方式是面向对象的。也就是说python-docx模块会把word文档,文档中的段落、文本、字体等都看做对象,对对象进行处理就是对word文档的内容处理。

二,相关概念

如果需要读取word文档中的文字(一般来说,程序也只需要认识word文档中的文字信息),需要先了解python-docx模块的几个概念。

1,Document对象,表示一个word文档。
2,Paragraph对象,表示word文档中的一个段落
3,Paragraph对象的text属性,表示段落中的文本内容。

三,模块的安装和导入

需要注意,python-docx模块安装需要在cmd命令行中输入pip install python-docx,如下图表示安装成功(最后那句英文Successfully installed,成功地安装完成,十分考验英文水平。)

Python读取word文本操作详解

注意在导入模块时,用的是import docx。

也真是奇了怪了,怎么安装和导入模块时,很多都不用一个名字,看来是很有必要出一个python版本的模块管理程序python-maven了,本段纯属PS。

四,读取word文本

在了解了上面的信息之后,就很简单了,下面先创建一个D:\temp\word.docx文件,并在其中输入如下内容。

Python读取word文本操作详解

然后写一段程序,代码及输出结果如下:

#读取docx中的文本代码示例
import docx
#获取文档对象
file=docx.Document("D:\\temp\\word.docx")
print("段落数:"+str(len(file.paragraphs)))#段落数为13,每个回车隔离一段

#输出每一段的内容
for para in file.paragraphs:
 print(para.text)

#输出段落编号及段落内容
for i in range(len(file.paragraphs)):
 print("第"+str(i)+"段的内容是:"+file.paragraphs[i].text)

运行结果:

================ RESTART: F:/360data/重要数据/桌面/学习笔记/readWord.py ================
段落数:13
啊

我看见一座山

雄伟的大山

真高啊

啊

这座山是!

真的很高!
第0段的内容是:啊
第1段的内容是:
第2段的内容是:我看见一座山
第3段的内容是:
第4段的内容是:雄伟的大山
第5段的内容是:
第6段的内容是:真高啊
第7段的内容是:
第8段的内容是:啊
第9段的内容是:
第10段的内容是:这座山是!
第11段的内容是:
第12段的内容是:真的很高!
>>>

总结

以上就是本文关于Python读取word文本操作详解的全部内容,希望对大家有所帮助。感兴趣的朋友可以继续参阅本站其他相关专题,如有不足之处,欢迎留言指出。感谢朋友们对本站的支持!

Python 相关文章推荐
Python正则表达式介绍
Aug 06 Python
python获得两个数组交集、并集、差集的方法
Mar 27 Python
老生常谈Python基础之字符编码
Jun 14 Python
python操作excel文件并输出txt文件的实例
Jul 10 Python
python一键去抖音视频水印工具
Sep 14 Python
Python 图像处理: 生成二维高斯分布蒙版的实例
Jul 04 Python
Pycharm+django2.2+python3.6+MySQL实现简单的考试报名系统
Sep 05 Python
flask 框架操作MySQL数据库简单示例
Feb 02 Python
Python threading模块condition原理及运行流程详解
Oct 05 Python
Python安装并操作redis实现流程详解
Oct 13 Python
教你用python实现12306余票查询
Jun 30 Python
python导出hive数据表的schema实例代码
Jan 22 #Python
Python的SimpleHTTPServer模块用处及使用方法简介
Jan 22 #Python
一道python走迷宫算法题
Jan 22 #Python
浅谈使用Python内置函数getattr实现分发模式
Jan 22 #Python
python正则表达式及使用正则表达式的例子
Jan 22 #Python
Python深度优先算法生成迷宫
Jan 22 #Python
Python使用Tkinter实现机器人走迷宫
Jan 22 #Python
You might like
PHP+Mysql树型结构(无限分类)数据库设计的2种方式实例
2014/07/15 PHP
PHP命令行脚本接收传入参数的三种方式
2014/08/20 PHP
php中return的用法实例分析
2015/02/28 PHP
PHP中的命名空间详细介绍
2015/07/02 PHP
学习php设计模式 php实现策略模式(strategy)
2015/12/07 PHP
PHP简单判断字符串是否包含另一个字符串的方法
2016/03/25 PHP
php图片合成方法(多张图片合成一张)
2017/11/25 PHP
php实现的PDO异常处理操作分析
2018/12/27 PHP
PHP 文件写入和读取操作实例详解【必看篇】
2019/11/04 PHP
Javascript常用运算符(Operators)-javascript基础教程
2007/12/14 Javascript
input+select(multiple) 实现下拉框输入值
2009/05/21 Javascript
Javascript中定义方法的另类写法(批量定义js对象的方法)
2011/02/25 Javascript
node.js中的fs.symlinkSync方法使用说明
2014/12/15 Javascript
详解AngularJS中$http缓存以及处理多个$http请求的方法
2016/02/06 Javascript
jQuery获取单击节点对象的方法
2016/06/02 Javascript
使用jQuery.Qrcode插件在客户端动态生成二维码并添加自定义Logo
2016/09/01 Javascript
jquery实现焦点轮播效果
2017/02/23 Javascript
angular动态删除ng-repaeat添加的dom节点的方法
2017/07/20 Javascript
JavaScript前端实现压缩图片功能
2020/03/06 Javascript
python多进程使用及线程池的使用方法代码详解
2018/10/24 Python
python实现LBP方法提取图像纹理特征实现分类的步骤
2019/07/11 Python
python多进程下实现日志记录按时间分割
2019/07/22 Python
Django:使用filter的pk进行多值查询操作
2020/07/15 Python
CSS3实现滚动条动画效果代码分享
2016/08/03 HTML / CSS
如何使用canvas绘制可移动网格的示例代码
2020/12/14 HTML / CSS
比驿:全球酒店比价网
2018/06/20 全球购物
奥地利度假券的专家:we-are.travel
2019/04/10 全球购物
英国最大的割草机购买网站:Just Lawnmowers
2019/11/02 全球购物
澳大利亚领先的内衣店:Bendon Lingerie澳大利亚
2020/05/15 全球购物
财务会计大学生自我评价
2014/04/09 职场文书
运动会口号16字
2014/06/07 职场文书
篮球兴趣小组活动总结
2014/07/07 职场文书
大学生党课心得体会
2016/01/07 职场文书
幼儿园教师辞职信
2019/06/21 职场文书
HTML页面滚动时部分内容位置固定不滚动的实现
2021/04/14 HTML / CSS
Springboot集成阿里云OSS上传文件系统教程
2021/06/28 Java/Android