spiders:你好污啊

'''python3
爬取网站:https://www.nihaowua.com/
爬取内容:撩妹金句
python库: requests + pyquery
'''

import requests
from pyquery import PyQuery as pq

url = 'https://www.nihaowua.com/'
headers = {
    'user-agent': 'Mozilla/5.0 (X11; Linux x86_64) AppleWebKit/537.36 (KHTML, like Gecko) Ubuntu Chromium/76.0.3809.87 Chrome/76.0.3809.87 Safari/537.36'
}

def spiders():
    re = requests.get(url=url, headers=headers)  # 爬取网页
    html = pq(re.text)
    text = html('section').text()  # 解析网页:section 节点 -> 取节点的文本内容
    return text

def main():
    count = 0
    while count < 100:
        text = spiders()
        print('第{}次爬取:{}'.format(count+1, text))
        count += 1

if __name__ == '__main__':
    main()
  • 执行结果
    在这里插入图片描述
  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值