scrapy 搜索关键字_Scrapy抓取动态网页

动态网页指几种可能:

1)需要用户交互,如常见的登录操作;

2)网页通过JS/ AJAX动态生成,如一个html里有

aaa

3)点击输入关键字后进行查询,而浏览器url地址不变

本篇文章不借助任何外部工具,实例操作如何以观察网络通信的方法解析动态网页。

环境:Win10 , python2.7,scrapy 1.4.0,Chrome浏览器,Firefox浏览器

1、观察是否为动态网页

以华盛顿邮报为例,搜索关键词 French ,搜索到的结果如下:

415b0655202e9402e02d3ecb716bc705.png

F12打开控制台,在Element下找到想要获得的搜索列表数据所在的section标签”main-content”

e32df7d1ea0a2f052d690cffa56bd4bc.png

然后转到Network的Doc标签,重新加载当前网页,在Name下点击第一个文件,在右边的Preview下寻找相应的section id 为 “main-content”的元素,发现没有数据:

  • 1
    点赞
  • 2
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值