当前位置:Gxlcms > Python > python生成词云方法教程

python生成词云方法教程

时间:2021-07-01 10:21:17 帮助过:81人阅读

期末复习比较忙过段时间来专门写scrapy框架使用,今天介绍如何用python生成词云,虽然网上有很多词云生成工具,不过自己用python来写是不是更有成就感。

今天要生成的是励志歌曲的词云,百度文库里面找了20来首,如《倔强》,海阔天空是,什么的大家熟悉的。

所要用到的python库有 jieba(一个中文分词库)、wordcould 、matplotlib、PIL、numpy。

首先我们要做的是读取歌词。我将歌词存在了文件目录下励志歌曲文本中。

现在来读取他

  1. #encoding=gbklyric= ''f=open('./励志歌曲歌词.txt','r')for i in f:
  2. lyric+=f.read()

加入#encoding=gbk是为了防止后面操作报错SyntaxError: Non-UTF-8 code starting with '\xc0'
然后我们用jieba分词来对歌曲做分词提取出词频高的词

  1. import jieba.analyse
  2. result=jieba.analyse.textrank(lyric,topK=50,withWeight=True)
  3. keywords = dict()for i in result:
  4. keywords[i[0]]=i[1]print(keywords)

得到结果:

然后我们就可以通过wrodcloud等库来生成词云了

首先先自己找一张图片来作为生成词云的形状的图

  1. from PIL import Image,ImageSequenceimport numpy as npimport matplotlib.pyplot as pltfrom wordcloud import WordCloud,ImageColorGenerator
  2. image= Image.open('./tim.jpg')
  3. graph = np.array(image)
  4. wc = WordCloud(font_path='./fonts/simhei.ttf',background_color='White',max_words=50,mask=graph)
  5. wc.generate_from_frequencies(keywords)
  6. image_color = ImageColorGenerator(graph)
  7. plt.imshow(wc)
  8. plt.imshow(wc.recolor(color_func=image_color))
  9. plt.axis("off")
  10. plt.show()

保存生成图片

  1. wc.to_file('dream.png')


完整代码:

  1. #encoding=gbkimport jieba.analysefrom PIL import Image,ImageSequenceimport numpy as npimport matplotlib.pyplot as pltfrom wordcloud import WordCloud,ImageColorGenerator
  2. lyric= ''f=open('./励志歌曲歌词.txt','r')for i in f:
  3. lyric+=f.read()
  4. result=jieba.analyse.textrank(lyric,topK=50,withWeight=True)
  5. keywords = dict()for i in result:
  6. keywords[i[0]]=i[1]print(keywords)
  7. image= Image.open('./tim.jpg')
  8. graph = np.array(image)
  9. wc = WordCloud(font_path='./fonts/simhei.ttf',background_color='White',max_words=50,mask=graph)
  10. wc.generate_from_frequencies(keywords)
  11. image_color = ImageColorGenerator(graph)
  12. plt.imshow(wc)
  13. plt.imshow(wc.recolor(color_func=image_color))
  14. plt.axis("off")
  15. plt.show()
  16. wc.to_file('dream.png')

以上就是python生成词云方法教程的详细内容,更多请关注Gxl网其它相关文章!

人气教程排行