温馨提示×

温馨提示×

您好,登录后才能下订单哦!

密码登录×
登录注册×
其他方式登录
点击 登录注册 即表示同意《亿速云用户服务条款》

运用jieba库的方法

发布时间:2020-07-08 15:26:47 来源:亿速云 阅读:376 作者:清晨 栏目:编程语言

小编给大家分享一下运用jieba库的方法,希望大家阅读完这篇文章后大所收获,下面让我们一起去探讨吧!

《斗破苍穹》可谓玄幻小说的巅峰之作,曾经痴迷到彻夜看小说,回不到的过去,等不到的未来!今天就利用python的jieba库以及在线制作词云工具TAGUL,制作《斗破苍穹》词云。

步骤

jieba分词

首先,通过pip3 install jieba安装jieba库,随后在网上下载《斗破苍穹》小说及停用词表。代码如下:

import jieba.analyse

path = '小说路径'
fp = open(path,'r',encoding='utf-8')
content = fp.read()
try:
    jieba.analyse.set_stop_words('停用词表路径')    
    tags = jieba.analyse.extract_tags(content, topK=100, withWeight=True)    
    for item in tags:
        print(item[0]+'\t'+str(int(item[1]*1000)))
finally:
     fp.close()

大家运行程序可能会报错,是编码问题,我们这时需打开下载的txt文档,另存为,选择utf-8编码即可。

运用jieba库的方法

运行部分结果图:

运用jieba库的方法

词云制作

(1)打开taglue官网,点击import words,把运行的结果copy过来。
(2)选择形状,在这里是网上下载的图片进行的导入。
(3)选择字体。
(4)点击Visualize生成图片。

运用jieba库的方法

《斗破苍穹》词云

运用jieba库的方法

在这个斗气大陆上,只有强者才可以生存,萧炎在药老及丹药的帮助下不断修炼,拥有多种异火,有着极强的灵魂感知力;在不断修炼中,遇到了小医仙,纳兰,美杜莎,紫研等人,成为斗气大陆上的强者而奋斗。

看完了这篇文章,相信你对运用jieba库的方法有了一定的了解,想了解更多相关知识,欢迎关注亿速云行业资讯频道,感谢各位的阅读!

向AI问一下细节

免责声明:本站发布的内容(图片、视频和文字)以原创、转载和分享为主,文章观点不代表本网站立场,如果涉及侵权请联系站长邮箱:is@yisu.com进行举报,并提供相关证据,一经查实,将立刻删除涉嫌侵权内容。

AI