spiders:你好污啊

最新推荐文章于 2024-05-02 12:02:46 发布

云雀叫了一整天啦

最新推荐文章于 2024-05-02 12:02:46 发布

阅读量5.4k

点赞数

本文链接：https://blog.csdn.net/weixin_40313634/article/details/100568462

版权

'''python3
爬取网站：https://www.nihaowua.com/
爬取内容：撩妹金句
python库： requests + pyquery
'''

import requests
from pyquery import PyQuery as pq

url = 'https://www.nihaowua.com/'
headers = {
    'user-agent': 'Mozilla/5.0 (X11; Linux x86_64) AppleWebKit/537.36 (KHTML, like Gecko) Ubuntu Chromium/76.0.3809.87 Chrome/76.0.3809.87 Safari/537.36'
}

def spiders():
    re = requests.get(url=url, headers=headers)  # 爬取网页
    html = pq(re.text)
    text = html('section').text()  # 解析网页：section 节点 -> 取节点的文本内容
    return text

def main():
    count = 0
    while count < 100:
        text = spiders()
        print('第{}次爬取：{}'.format(count+1, text))
        count += 1

if __name__ == '__main__':
    main()

执行结果

确定要放弃本次机会？

福利倒计时

: :

立减 ¥

普通VIP年卡可用

立即使用

云雀叫了一整天啦

关注关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
spiders:你好污啊

'''python3爬取网站：https://www.nihaowua.com/爬取内容：撩妹金句python库： requests + pyquery'''import requestsfrom pyquery import PyQuery as pqurl = 'https://www.nihaowua.com/'headers = { 'user-agent':...
复制链接

扫一扫