Python制作词云图代码实例


Posted in Python onSeptember 09, 2019

词云图是将词汇按照频率的高低显示不同大小而形成的图,可以一目了然地看出关键词。下面是词云图的python代码~

#导入需要模块
import jieba
import numpy as np 
import matplotlib.pyplot as plt 
from PIL import Image 
from wordcloud import WordCloud, STOPWORDS, ImageColorGenerator

text_road=str(input('请输入文章的路径:'))
picture_road=str(input('请输入图片的路径:'))

#加载需要分析的文章
text = open(text_road,'r',encoding='utf-8').read()

#对文章进行分词
wordlist_after_jieba = jieba.cut(text, cut_all=False)
wl_space_split = " ".join(wordlist_after_jieba)

#读取照片通过numpy.array函数将照片等结构数据转化为np-array
mask=np.array(Image.open(picture_road))

#选择屏蔽词,不显示在词云里面
stopwords = set(STOPWORDS)
#可以加多个屏蔽词
stopwords.add("<br/>")

#创建词云对象
wc = WordCloud(
    background_color="white",
    font_path='/Library/Fonts/Arial Unicode.ttf',
    max_words=1000, # 最多显示词数
    mask=mask, 
    stopwords=stopwords,
    max_font_size=100 # 字体最大值
    )

#生成词云
wc.generate(text)

#从背景图建立颜色方案
image_colors =ImageColorGenerator(mask) 

#将词云颜色设置为背景图方案
wc.recolor(color_func=image_colors) 

#显示词云
plt.imshow(wc,interpolation='bilinear')

#关闭坐标轴
plt.axis("off")

#显示图像
plt.show()

#保存词云
wc.to_file('词云图.png')

下面这张图是我爬了阿里巴巴招聘网站上所有数据分析职位需求,生成的词云图,大家可以看看阿里对数据分析师的要求~

Python制作词云图代码实例

以上就是本文的全部内容,希望对大家的学习有所帮助,也希望大家多多支持三水点靠木。

Python 相关文章推荐
Python日期操作学习笔记
Oct 07 Python
Python 解析XML文件
Apr 15 Python
Python的lambda匿名函数的简单介绍
Apr 25 Python
python实现微信发送邮件关闭电脑功能
Feb 22 Python
Pyinstaller将py打包成exe的实例
Mar 31 Python
python实现大量图片重命名
Mar 23 Python
opencv3/C++ 平面对象识别&amp;透视变换方式
Dec 11 Python
Python 脚本的三种执行方式小结
Dec 21 Python
Python中 Global和Nonlocal的用法详解
Jan 20 Python
使用ITK-SNAP进行抠图操作并保存mask的实例
Jul 01 Python
Django 权限管理(permissions)与用户组(group)详解
Nov 30 Python
python 基于opencv去除图片阴影
Jan 26 Python
PyCharm2018 安装及破解方法实现步骤
Sep 09 #Python
浅谈pycharm使用及设置方法
Sep 09 #Python
在pycharm中配置Anaconda以及pip源配置详解
Sep 09 #Python
django 多对多表的创建和插入代码实现
Sep 09 #Python
Python中的单下划线和双下划线使用场景详解
Sep 09 #Python
python 批量修改 labelImg 生成的xml文件的方法
Sep 09 #Python
Python定时发送天气预报邮件代码实例
Sep 09 #Python
You might like
php中获取关键词及所属来源搜索引擎名称的代码
2011/02/15 PHP
php学习之 数组声明
2011/06/09 PHP
javascript 拖动表格行实现代码
2011/05/05 Javascript
使用GruntJS构建Web程序之合并压缩篇
2014/06/06 Javascript
JavaScript 七大技巧(一)
2015/12/13 Javascript
几种经典排序算法的JS实现方法
2016/03/25 Javascript
Nodejs下DNS缓存问题浅析
2016/11/16 NodeJs
Vue2.x中的Render函数详解
2017/05/30 Javascript
解决ie img标签内存泄漏的问题
2017/10/13 Javascript
把vue-router和express项目部署到服务器的方法
2018/02/21 Javascript
vue.js响应式原理解析与实现
2020/06/22 Javascript
如何实现一个webpack模块解析器
2018/10/24 Javascript
微信接入之获取用户头像的方法步骤
2019/09/23 Javascript
layui 富文本图片上传接口与普通按钮 文件上传接口的例子
2019/09/23 Javascript
layui table 复选框跳页后再回来保持原来选中的状态示例
2019/10/26 Javascript
Pyhthon中使用compileall模块编译源文件为pyc文件
2015/04/28 Python
python实现简单五子棋游戏
2019/06/18 Python
python pickle存储、读取大数据量列表、字典数据的方法
2019/07/07 Python
Python自动化之UnitTest框架实战记录
2020/09/08 Python
python各种excel写入方式的速度对比
2020/11/10 Python
Python实现区域填充的示例代码
2021/02/03 Python
HTML5手指下滑弹出负一屏阻止移动端浏览器内置下拉刷新功能的实现代码
2020/04/10 HTML / CSS
皇马官方商城:Real Madrid Store
2016/09/02 全球购物
Under Armour美国官网:美国知名高端功能性运动品牌
2016/09/05 全球购物
猫途鹰:全球领先的旅游点评社区
2017/04/07 全球购物
健身场所或家用健身设备:Life Fitness
2017/11/01 全球购物
PHP面试题附答案
2015/11/28 面试题
求职自荐信怎么写
2014/03/06 职场文书
小学优秀教师材料
2014/12/15 职场文书
优秀工作者事迹材料
2014/12/26 职场文书
浅谈Python中的正则表达式
2021/06/28 Python
Vue.js中v-for指令的用法介绍
2022/03/13 Vue.js
CSS实现渐变色边框(Gradient borders)的5种方法
2022/03/25 HTML / CSS
MySQL Server层四个日志的实现
2022/03/31 MySQL
CDPR谈《巫师》新作用虚幻5原因 称不会为Epic独占
2022/04/06 其他游戏
Nginx 常用配置
2022/05/15 Servers