使用PhantomJS实现模拟登陆(Java爬虫)

本文介绍了如何使用PhantomJS进行模拟登陆,特别是在处理.aspx网页时。PhantomJS是一个无头浏览器,提供了JavaScript API接口,适用于网页抓取和自动化测试。通过Java调用PhantomJS,可以实现登录并获取cookie,进而用于后续数据获取。虽然在开发过程中遇到一些问题,如图片截图背景变黑的bug,但总体体验良好。作者还探讨了在遇到JavaScript禁用右键的情况时,可以关闭浏览器的JavaScript支持或使用其他工具。最后,作者计划将PhantomJS与selenium结合,并学习JavaScript来提升爬虫开发能力。
摘要由CSDN通过智能技术生成

PhantomJS介绍

最近开发爬虫的时候,遇到.aspx后缀的网页需要去模拟登陆然后获取cookie,本来计划通过selenium进行登陆,但是效果很不好红色警告很多,似乎selenium对于JavaScript支持不是很好。在查过资料之后,发现了PhantomJS这一大杀器,基本满足爬虫很多需要,便决定使用PhantomJS进行开发模拟登陆。
以下是对于PhantomJS的介绍
(1)一个基于webkit内核的无头浏览器,即没有UI界面,即它就是一个浏览器,只是其内的点击、翻页等人为相关操作需要程序设计实现。
(2)提供javascript API接口,即通过编写js程序可以直接与webkit内核交互,在此之上可以结合java语言等,通过java调用js等相关操作,从而解决了以前c/c++才能比较好的基于webkit开发优质采集器的限制。
(3)提供windows、linux、mac等不同os的安装使用包,也就是说可以在不同平台上二次开发采集项目或是自动项目测试等工作。
PhantomJS介绍资料来源

PhantomJS进行模拟登陆

这次计划将使用Java+phantomjs进行开发,因为本人开发爬虫主要通过Java。
首先上JavaScript代码

  • 1
    点赞
  • 10
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值