2021-05-11

最新推荐文章于 2021-11-05 18:47:52 发布

liang梁

最新推荐文章于 2021-11-05 18:47:52 发布

阅读量74

点赞数

分类专栏： python spider

本文链接：https://blog.csdn.net/m0_47034583/article/details/116668771

版权

python 同时被 2 个专栏收录

6 篇文章 0 订阅

订阅专栏

spider

1 篇文章 0 订阅

订阅专栏

爬取阿里招聘网
在职位搜索中输入 python，获取前3页的数据，包括职位名称、职位类别、工作地点、招聘人数，把数据存入字典格式，保存在文本中
经分析,这些数据在json数据里面,获取世纪要爬取的url
在这里插入图片描述
网页的请求数据:

import json
import requests


def job_data(page):
    # 数据在ajax里面,实际爬取的网页
    url = 'https://job.alibaba.com/zhaopin/socialPositionList/doList.json'
    # 添加请求头
    headers = {
        'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/89.0.4389.128 Safari/537.36'
    }
    # 添加请求数据
    data = {
        'pageSize': '10',
        't': '0.15070338056269827',
        'keyWord': 'python',
        'pageIndex': f'{page}'
    }
    # 向服务端发送请求
    res = requests.post(url=url, headers=headers, data=data)
    # 获取包含所需的json数据
    result = res.json()

    data = {}
    for job in result['returnValue']['datas']:
        data['name'] = job['name']  # 职位名称
        data['types'] = job['firstCategory']  # 职位类型
        data['address'] = job['workLocation']  # 工作地点
        data['num'] = job['recruitNumber']  # 招聘人数
        # 自动创建data.json文件
        with open('data.json', 'a', encoding='utf-8') as fp:
            # 写入json数据
            fp.write(json.dumps(data,ensure_ascii=False)+'\n')

if __name__ == '__main__':
    for i in range(1, 4):
        job_data(i)

liang梁

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
2021-05-11

爬取阿里招聘网在职位搜索中输入 python，获取前3页的数据，包括职位名称、职位类别、工作地点、招聘人数，把数据存入字典格式，保存在文本中经分析,这些数据在json数据里面,获取世纪要爬取的url网页的请求数据:import jsonimport requestsdef job_data(page): # 数据在ajax里面,实际爬取的网页 url = 'https://job.alibaba.com/zhaopin/socialPositionList/doLis
复制链接

扫一扫

专栏目录