头歌urllib爬虫-第一关

许晨梦

已于 2022-04-19 17:02:30 修改

阅读量4.7k

点赞数 2

文章标签： python

于 2022-04-19 17:01:16 首次发布

本文链接：https://blog.csdn.net/dearlwy521/article/details/124278231

版权

此篇博客介绍了如何使用Python的urllib和http.cookiejar库，通过设置Cookie处理HTTP请求，实现对指定URL的高效抓取。重点在于理解Cookie的工作原理和在实际项目中的应用。

摘要由CSDN通过智能技术生成

import urllib.request
import http.cookiejar
def request(url,headers):
    '''
    两个参数
    :param url:统一资源定位符,请求网址
    :param headers:请求头
    :return:html
    '''
    
    # ***************** Begin ******************** #
    cookie = http.cookiejar.CookieJar()
    handler = urllib.request.HTTPCookieProcessor(cookie) 
    opener = urllib.request.build_opener(handler)
    r=  opener.open(url)
    
    # ***************** End ******************** #
    html = r.read().decode('utf-8')
    return html

确定要放弃本次机会？

福利倒计时

: :

立减 ¥

普通VIP年卡可用

立即使用

许晨梦

关注关注

2
点赞
踩
5

收藏

觉得还不错? 一键收藏
0
评论
头歌urllib爬虫-第一关

import urllib.requestimport http.cookiejardef request(url,headers): ''' 两个参数 :param url:统一资源定位符,请求网址 :param headers:请求头 :return:html ''' # ***************** Begin ******************** # cookie = http.cookiejar.Cookie.
复制链接

扫一扫