Python数据分析之jieba库的运用

本文介绍利用Python的jieba库和在线工具TAGUL制作《斗破苍穹》词云。先通过pip3安装jieba库,下载小说及停用词表,解决编码问题后进行分词。再打开TAGUL官网,导入分词结果,选择形状、字体后生成词云图片。

摘要生成于 C知道 ,由 DeepSeek-R1 满血版支持, 前往体验 >

三十年河东,三十年河西,莫欺少年穷!年仅15岁的萧家废物,于此地,立下了誓言,从今以后便一步步走向斗气大陆巅峰!这里是属于斗气的世界,没有花俏艳丽的魔法,有的,仅仅是繁衍到巅峰的斗气!

《斗破苍穹》可谓玄幻小说的巅峰之作,曾经痴迷到彻夜看小说,回不到的过去,等不到的未来!今天就利用python的jieba库以及在线制作词云工具TAGUL,制作《斗破苍穹》词云。

步骤

jieba分词

首先,通过pip3 install jieba安装jieba库,随后在网上下载《斗破苍穹》小说及停用词表。代码如下:

import jieba.analyse	
path = '小说路径'	
fp = open(path,'r',encoding='utf-8')	
content = fp.read()	
try:	
    jieba.analyse.set_stop_words('停用词表路径')	
    tags = jieba.analyse.extract_tags(content, topK=100, withWeight=True)	
    for item in tags:	
        print(item[0]+'\t'+str(int(item[1]*1000)))	
finally:	
    fp.close()

大家运行程序可能会报错,是编码问题,我们这时需打开下载的txt文档,另存为,选择utf-8编码即可。640?wx_fmt=png运行部分结果图:640?wx_fmt=png

词云制作

(1)打开taglue官网,点击import words,把运行的结果copy过来。 (2)选择形状,在这里是网上下载的图片进行的导入。 (3)选择字体。 (4)点击Visualize生成图片。640?wx_fmt=png

《斗破苍穹》词云

640?wx_fmt=png在这个斗气大陆上,只有强者才可以生存,萧炎在药老及丹药的帮助下不断修炼,拥有多种异火,有着极强的灵魂感知力;在不断修炼中,遇到了小医仙,纳兰,美杜莎,紫研等人,成为斗气大陆上的强者而奋斗。

近期热门:

一个300多万人玩的闯关趣味Python网站

爬虫界又出神器|一款比selenium更高效的利器

用Python来解读神奇宝贝


评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值