Python不用第三方模块爬取数据

在编写爬虫程序时,我们通常都引入第三方模块来实现网页数据的获取和处理。但是,通过自己对数据结构的分析,也可以免去下载安装第三方模块的麻烦。下面的函数只使用Python自带的模块,可以从网站获取股票价格。

import urllib.request

def getPrice(stockNum):
url = “https://hq.gucheng.com/” + stockNum
page = urllib.request.urlopen(url)
html = page.read().decode(‘utf-8’) #存入网页文本到page
lines = html.split(“em class=”)#找到价格行
line = lines[1].split(">")#剥除无用字符
prices = line[1].split("<")#剥除无用字符
price = prices[0]#找到价格字符串
return price

  • 1
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值