PHP加JavaScript爬取网页内容,超实用简易教程

php+js爬取网页内容-----先看下效果

我的网站目标网站

如何做到的呢?

我们一直以为只有Python才能爬取网页内容,那是因为Python本身集合很多类库用来爬取网页很方便,但是我们使用PHP+js的方法一样很方便,一样可以拿到我们想要的网页内容,而且也不用很繁琐。

首先我们需要PHP来模拟请求获取整个网站的HTML
  // 允许所有域访问
header("Access-Control-Allow-Origin: *");
// 接收一个参数,参数名叫parm
$parm=$_GET['mod'];
if (empty($parm)) {
	$url = 'http://m.80s.tw/';//目标网站
	$html = file_get_contents($url);
}else{
	$url = 'http://m.80s.tw/'.$parm;
	$html = file_get_contents($url);
} 
	preg_match("/<body[^>]*?>(.*\s*?)<\/body>/is",$html,$match1);//正则匹配body里面的内容
	echo $match1[0];//输出网页
注意:如果遇到 file_get_contents报错请尝试在 php.ini中找到extension=php_openssl.dll 开启就OK了
然后就是前端来获取数据进行处理了

首先写个异步请求

$.ajax({ 
	    type:'get',
	    url: '.././admin/test.php',
	    success: function(data) {
	    console.log(data)//可以看到获取的HTML,很简单吧,很兴奋吧
	    }
	});
获取HTML后我们就可以随心所欲了
怎么来使用这些HTML呢?这是问题吗?不是
		//首先创建一个容器
		var div = document.createElement('div');
        // 把整个html的字符串存到这个div节点里
        div.innerHTML = data;
        //然后就可以对div一顿检查了
        //比如获取类list_mov_title下所有的a标签
        var list = div.querySelectorAll('.list_mov_title a');
        //赶紧打印出来看一下
        console.log(list)
        //想要的东西都在吧
        //然后就把想要的东西往自己的页面里面塞吧
一个爬取网页内容的教程就这样结束了,如果你豁然开朗了就转发一下吧,不明白的就留言吧

感兴趣的加个微信交流一下吧,实在没时间一直上csdn,而且csdn上沟通也不太方便啊
个人微信 17771806167 或下面扫码

  • 1
    点赞
  • 5
    收藏
    觉得还不错? 一键收藏
  • 打赏
    打赏
  • 2
    评论
评论 2
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

小鸣blog

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值