运用jieba库的方法
小编给大家分享一下运用jieba库的方法,希望大家阅读完这篇文章后大所收获,下面让我们一起去探讨吧!
成都创新互联公司服务项目包括邛崃网站建设、邛崃网站制作、邛崃网页制作以及邛崃网络营销策划等。多年来,我们专注于互联网行业,利用自身积累的技术优势、行业经验、深度合作伙伴关系等,向广大中小型企业、政府机构等提供互联网行业的解决方案,邛崃网站推广取得了明显的社会效益与经济效益。目前,我们服务的客户以成都为中心已经辐射到邛崃省份的部分城市,未来相信会继续扩大服务区域并继续获得客户的支持与信任!
《斗破苍穹》可谓玄幻小说的巅峰之作,曾经痴迷到彻夜看小说,回不到的过去,等不到的未来!今天就利用python的jieba库以及在线制作词云工具TAGUL,制作《斗破苍穹》词云。
步骤
jieba分词
首先,通过pip3 install jieba安装jieba库,随后在网上下载《斗破苍穹》小说及停用词表。代码如下:
import jieba.analyse path = '小说路径' fp = open(path,'r',encoding='utf-8') content = fp.read() try: jieba.analyse.set_stop_words('停用词表路径') tags = jieba.analyse.extract_tags(content, topK=100, withWeight=True) for item in tags: print(item[0]+'\t'+str(int(item[1]*1000))) finally: fp.close()
大家运行程序可能会报错,是编码问题,我们这时需打开下载的txt文档,另存为,选择utf-8编码即可。
运行部分结果图:
词云制作
(1)打开taglue官网,点击import words,把运行的结果copy过来。
(2)选择形状,在这里是网上下载的图片进行的导入。
(3)选择字体。
(4)点击Visualize生成图片。
《斗破苍穹》词云
在这个斗气大陆上,只有强者才可以生存,萧炎在药老及丹药的帮助下不断修炼,拥有多种异火,有着极强的灵魂感知力;在不断修炼中,遇到了小医仙,纳兰,美杜莎,紫研等人,成为斗气大陆上的强者而奋斗。
看完了这篇文章,相信你对运用jieba库的方法有了一定的了解,想了解更多相关知识,欢迎关注创新互联行业资讯频道,感谢各位的阅读!
新闻标题:运用jieba库的方法
网址分享:http://pwwzsj.com/article/pjpcpc.html