Python不用第三方模块爬取数据

最新推荐文章于 2022-01-20 22:35:43 发布

业余老猿

最新推荐文章于 2022-01-20 22:35:43 发布

阅读量422

点赞数 1

本文链接：https://blog.csdn.net/swkcs/article/details/104311655

版权

在编写爬虫程序时，我们通常都引入第三方模块来实现网页数据的获取和处理。但是，通过自己对数据结构的分析，也可以免去下载安装第三方模块的麻烦。下面的函数只使用Python自带的模块，可以从网站获取股票价格。

import urllib.request

def getPrice(stockNum):
url = “https://hq.gucheng.com/” + stockNum
page = urllib.request.urlopen(url)
html = page.read().decode(‘utf-8’) #存入网页文本到page
lines = html.split(“em class=”)#找到价格行
line = lines[1].split(">")#剥除无用字符
prices = line[1].split("<")#剥除无用字符
price = prices[0]#找到价格字符串
return price