python爬取js_利用python如何爬取js里面的内容

最新推荐文章于 2024-05-29 15:23:22 发布

weixin_39639965

最新推荐文章于 2024-05-29 15:23:22 发布

阅读量3k

点赞数

文章标签： python爬取js

本篇文章给大家分享的内容是3利用python如何爬取js里面的内容，有着一定的参考价值，有需要的朋友可以参考一下

一、在编写爬虫软件获取所需内容时可能会碰到所需要的内容是由javascript添加上去的在获取的时候为空比如我们在获取新浪新闻的评论数时使用普通的方法就无法获取

Center

普通获取代码示例：import requests

from bs4 import BeautifulSoup

res = requests.get('http://news.sina.com.cn/c/nd/2017-06-12/doc-ifyfzhac1650783.shtml')

res.encoding = 'utf-8'

soup = BeautifulSoup(res.text,'html.parser')

#取评论数

commentCount = soup.select_one('#commentCount1')

print(commentCount.text)

此时所获取的结果为空这是由于内容是存储在js文件中

因此我们需要取寻找存储评论内容的js 经过查找我们发现其存储在改js里

Center

将相应内容放入json数据查看器中我们发现评论总数和评论内容都在该js文件中一json格式存放

最低0.47元/天解锁文章

weixin_39639965

关注

0
点赞
踩
9

收藏

觉得还不错? 一键收藏
0
评论
python爬取js_利用python如何爬取js里面的内容

本篇文章给大家分享的内容是3利用python如何爬取js里面的内容，有着一定的参考价值，有需要的朋友可以参考一下一、在编写爬虫软件获取所需内容时可能会碰到所需要的内容是由javascript添加上去的在获取的时候为空比如我们在获取新浪新闻的评论数时使用普通的方法就无法获取普通获取代码示例：import requestsfrom bs4 import BeautifulSoupres = re...
复制链接

扫一扫

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。