火车头采集器使用

介绍一下爬取网页的神器,火车头采集器的使用教程

下面以电商网站tophatter电商网站为例
下载地址:https://download.csdn.net/download/qq_35257875/11164832

  1. 新建任务
    在这里插入图片描述

  2. 向导添加
    在这里插入图片描述

  3. 批量网址
    在这里插入图片描述
    地址设为上图格式
    地址参数为1开始 (就是商品的id编号) 我从115697202开始测的后面1000条 基本100条无效

  4. 点击设置
    在这里插入图片描述

  5. 填写任务名保存
    在这里插入图片描述

  6. 内容采集
    设置需要爬取的字段
    这里采用前后截取,购买过的可以使用json提取。
    在这里插入图片描述
    所有字段格式与上图相同
    在这里插入图片描述
    在这里插入图片描述
    在这里插入图片描述
    在这里插入图片描述
    在这里插入图片描述
    在这里插入图片描述
    保存并退出
    字段来源:https://tophatter.com/api/v1/lots/115697202

  7. 主界面开始任务
    在这里插入图片描述

  8. 等待采集完成后
    点击数据 复制内容到excel即可

在这里插入图片描述

  • 0
    点赞
  • 10
    收藏
    觉得还不错? 一键收藏
  • 1
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论 1
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值