爬虫如何抓取到Asp.Net中__doPostBack获取新页面的数据

在Web 2.0时代,很多网站采用AJAX技术实现,带来较好用户体验的代价是,Javascript得到的内容搜索引擎无法爬到,Google也正在研究此种技术。本文讨论Asp.Net程序生成的链接,爬虫如何能爬进去的问题。
问题:某网站出现的数据列表分页显示,而上一页和下一页都是用__doPostBack提交到后台处理,如javascript:__doPostBack('ucInfoListMore$gridInfoList$_ctl21$_ctl1',''),我们根本得不到他绝对链接的地址,而且每一页得下一页传入的参数是一样的。
分析:我们首先理解__doPostBack做了哪些事情。
ExpandedBlockStart.gif ContractedBlock.gif function  __doPostBack(eventTarget, eventArgument)  dot.gif {
InBlock.gif
var theform;
ExpandedSubBlockStart.gifContractedSubBlock.gif
if (window.navigator.appName.toLowerCase().indexOf("netscape"> -1dot.gif{
InBlock.giftheform 
= document.forms["Form1"];//注意此处的FormID
ExpandedSubBlockStart.gifContractedSubBlock.gif
}
 else dot.gif{
InBlock.giftheform 
= document.Form1;//还有此处
ExpandedSubBlockEnd.gif
}

InBlock.giftheform.__EVENTTARGET.value 
= eventTarget.split("$").join(":");
InBlock.giftheform.__EVENTARGUMENT.value 
= eventArgument;
InBlock.giftheform.submit();
ExpandedBlockEnd.gif}

明白了吧,问题就在.__EVENTTARGET(后台处理的事件)和__EVENTARGUMENT上。这样就简单了,我们可以给这两个参数赋值,然后向后台发送Post就可以了。那么如何指定某一页呢,Asp.Net在后台是以Session方式保存当前页信息的,我们在Post得时候能够保证实在同一个会话中进行的就可以了。
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值