前言
今天教大家用wrodcloud模块来生成词云,我读取了一篇小说并生成了词云,先看一下效果图:
效果图一:
效果图二:
根据效果图分析的还是比较准确的,小说中的主人公就是“程理”,所以出现次数最多。图中有两种模式,一种是默认的模式,另一种是自己添加图片作为背景。下面我就带大家一起来学习怎样去生成词云!
wordcloud的安装
对于新人来说安装wordcloud模块就是一大关,我们一般都是通过pycharm或者pip安装的,但是在安装wordcloud时会提示错误,如下:
我的解决方法是直接访问下面的网址,根据你的电脑和py版本下载对应的whl文件
https://www.lfd.uci.edu/~gohlke/pythonlibs/#wordcloud
下载完成后,把whl文件放在pip路径下,输入下面的代码,记住代码的whl文件名一定是适合你的文件名,我只是举例:
1
|
pip install wordcloud - 1.4 . 1 - cp36 - cp36m - win32.whl |
运行后会显示安装成功
wordcloud的简单用法
wordcloud的基本方法,看源码如下:
各个参数大家应该一看就明白,另外wordcloud还有几个其他方法,比如fit_words,generate(text),to_file(filename)等等都是非常好理解的。
wordcloud生成词云
效果图一的代码:
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
|
from wordcloud import wordcloud import matplotlib.pyplot as plt #绘制图像的模块 import jieba #jieba分词 path_txt = 'c://users/administrator/desktop/all.txt' f = open (path_txt, 'r' ,encoding = 'utf-8' ).read() # 结巴分词,生成字符串,wordcloud无法直接生成正确的中文词云 cut_text = " " .join(jieba.cut(f)) wordcloud = wordcloud( #设置字体,不然会出现口字乱码,文字的路径是电脑的字体一般路径,可以换成别的 font_path = "c:/windows/fonts/simfang.ttf" , #设置了背景,宽高 background_color = "white" ,width = 1000 ,height = 880 ).generate(cut_text) plt.imshow(wordcloud, interpolation = "bilinear" ) plt.axis( "off" ) plt.show() |
运行后:
效果图二,给词云加上图片背景,代码如下:
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
|
from pil import image from wordcloud import wordcloud, imagecolorgenerator import matplotlib.pyplot as plt import numpy as np import jieba def getwordcloud(): path_txt = 'c://users/administrator/desktop/all.txt' path_img = "c://users/administrator/desktop/timg.jpg" f = open (path_txt, 'r' , encoding = 'utf-8' ).read() background_image = np.array(image. open (path_img)) # 结巴分词,生成字符串,如果不通过分词,无法直接生成正确的中文词云,感兴趣的朋友可以去查一下,有多种分词模式 #python join() 方法用于将序列中的元素以指定的字符连接生成一个新的字符串。 cut_text = " " .join(jieba.cut(f)) wordcloud = wordcloud( # 设置字体,不然会出现口字乱码,文字的路径是电脑的字体一般路径,可以换成别的 font_path = "c:/windows/fonts/simfang.ttf" , background_color = "white" , # mask参数=图片背景,必须要写上,另外有mask参数再设定宽高是无效的 mask = background_image).generate(cut_text) # 生成颜色值 image_colors = imagecolorgenerator(background_image) # 下面代码表示显示图片 plt.imshow(wordcloud.recolor(color_func = image_colors), interpolation = "bilinear" ) plt.axis( "off" ) plt.show() if __name__ = = '__main__' : getwordcloud() |
运行后:
以上就是本文的全部内容,希望对大家的学习有所帮助,也希望大家多多支持服务器之家。
原文链接:https://segmentfault.com/a/1190000015119009