Pyecharts绘制词云图(权重值)

目录

数据

代码

效果图展示


数据

爬取学校官网的任意一篇新闻的内容,然后使用jieba模块对该新闻的内容进行关键字提取,使用得到的提取结果的权重值最高的前50个词语,绘制一个词云图。(这里爬的是我学校的官网)

代码

from urllib.request import urlopen
from bs4 import BeautifulSoup
from jieba.analyse import extract_tags
from pyecharts import WordCloud
response = urlopen("http://www.gxstnu.edu.cn/info/1024/10188.htm")
source = response.read()
source = str(source,encoding="utf-8")
soup01 = BeautifulSoup(source,features="html.parser")
div_content = soup01.find("div",attrs={"class":"v_news_content"})
# print(div_content)
soup02 = BeautifulSoup(str(div_content),features="html.parser")
p_list = soup02.find_all("p")
a_str = ""
for i in p_list:
    a_str = a_str + i.text
# print(a_str)
# 计算权重 取出前50位
tf_idf_w = extract_tags(a_str,topK=50,withWeight=True)
print(tf_idf_w)
data_x = []
data_y = []
for i,j in tf_idf_w:
    data_x.append(i)
    data_y.append(j)
# print(data_x)
# print(data_y)
wc=WordCloud("关键字提取结果(前50位)")
wc.add("", data_x, data_y,shape='star')
wc.render("关键字.html")

效果图展示

注意:pyecharts是0.5.11版本。

  • 0
    点赞
  • 6
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值