前往小程序,Get更优阅读体验!
立即前往
首页
学习
活动
专区
工具
TVP
发布
社区首页 >专栏 >Python数据分析之jieba库的运用步骤词云制作《斗破苍穹》词云

Python数据分析之jieba库的运用步骤词云制作《斗破苍穹》词云

作者头像
罗罗攀
发布2018-07-03 13:57:02
6460
发布2018-07-03 13:57:02
举报
文章被收录于专栏:有趣的Python和你

三十年河东,三十年河西,莫欺少年穷!年仅15岁的萧家废物,于此地,立下了誓言,从今以后便一步步走向斗气大陆巅峰!这里是属于斗气的世界,没有花俏艳丽的魔法,有的,仅仅是繁衍到巅峰的斗气!

《斗破苍穹》可谓玄幻小说的巅峰之作,曾经痴迷到彻夜看小说,回不到的过去,等不到的未来!今天就利用python的jieba库以及在线制作词云工具TAGUL,制作《斗破苍穹》词云。

步骤

jieba分词

首先,通过pip3 install jieba安装jieba库,随后在网上下载《斗破苍穹》小说及停用词表。代码如下:

代码语言:javascript
复制
import jieba.analyse

path = '小说路径'

fp = open(path,'r',encoding='utf-8')
content = fp.read()
try:
    jieba.analyse.set_stop_words('停用词表路径')
    tags = jieba.analyse.extract_tags(content, topK=100, withWeight=True)
    for item in tags:
        print(item[0]+'\t'+str(int(item[1]*1000)))

finally:
    fp.close()

大家运行程序可能会报错,是编码问题,我们这时需打开下载的txt文档,另存为,选择utf-8编码即可。

运行部分结果图:

词云制作

(1)打开taglue官网,点击import words,把运行的结果copy过来。 (2)选择形状,在这里是网上下载的图片进行的导入。 (3)选择字体。 (4)点击Visualize生成图片。

《斗破苍穹》词云

在这个斗气大陆上,只有强者才可以生存,萧炎在药老及丹药的帮助下不断修炼,拥有多种异火,有着极强的灵魂感知力;在不断修炼中,遇到了小医仙,纳兰,美杜莎,紫研等人,成为斗气大陆上的强者而奋斗。

本文参与 腾讯云自媒体同步曝光计划,分享自作者个人站点/博客。
原始发表:2017.02.23 ,如有侵权请联系 cloudcommunity@tencent.com 删除

本文分享自 作者个人站点/博客 前往查看

如有侵权,请联系 cloudcommunity@tencent.com 删除。

本文参与 腾讯云自媒体同步曝光计划  ,欢迎热爱写作的你一起参与!

评论
登录后参与评论
0 条评论
热度
最新
推荐阅读
目录
  • 步骤
    • jieba分词
    • 词云制作
    • 《斗破苍穹》词云
    领券
    问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档