python爬虫:爬取豆瓣网电影信息

最新推荐文章于 2023-09-12 14:49:40 发布

Jmayday

最新推荐文章于 2023-09-12 14:49:40 发布

阅读量775

点赞数

分类专栏： python爬虫

本文链接：https://blog.csdn.net/Jmayday/article/details/106132050

版权

python爬虫专栏收录该内容

8 篇文章 0 订阅

订阅专栏

豆瓣网：

代码如下：

import requests
import urllib.request
if __name__ == "__main__":

    #指定ajax-get请求的url（通过抓包进行获取）
    url = 'https://movie.douban.com/j/new_search_subjects?sort=U&range=0,10&tags=&start=0&genres=%E5%8A%A8%E4%BD%9C'

    #定制请求头信息，相关的头信息必须封装在字典结构中
    headers = {
        #定制请求头中的User-Agent参数，当然也可以定制请求头中其他的参数
        'User-Agent': 'Mozilla/5.0 (Windows NT 6.1; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/66.0.3359.181 Safari/537.36',
    }
import requests
import urllib.request
if __name__ == "__main__":

    #指定ajax-get请求的url（通过抓包进行获取）
    url = 'https://movie.douban.com/j/new_search_subjects?sort=U&range=0,10&tags=&start=0&genres=%E5%8A%A8%E4%BD%9C'

    #定制请求头信息，相关的头信息必须封装在字典结构中
    headers = {
        #定制请求头中的User-Agent参数，当然也可以定制请求头中其他的参数
        'User-Agent': 'Mozilla/5.0 (Windows NT 6.1; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/66.0.3359.181 Safari/537.36',
    }

    #定制get请求携带的参数(从抓包工具中获取)
    param = {
       ' sort':' U',
        'range': '0,10',
        'tags': '',
        'start': '0',
        'genres': '动作',
    }
    #发起get请求，获取响应对象
    response = requests.get(url=url,headers=headers,params=param)

    #获取响应内容：响应内容为json串
    print(response.text)

显示结果：

Jmayday

关注

0
点赞
踩
1

收藏

觉得还不错? 一键收藏
0
评论
python爬虫:爬取豆瓣网电影信息

豆瓣网：代码如下：import requestsimport urllib.requestif __name__ == "__main__": #指定ajax-get请求的url（通过抓包进行获取） url = 'https://movie.douban.com/j/new_search_subjects?sort=U&range=0,10&tags=&start=0&genres=%E5%8A%A8%E4%BD%9C' #定制请
复制链接

扫一扫

专栏目录