爬取网页数据php,详细介绍PHP+JavaScript如何爬取网页内容

最新推荐文章于 2024-06-25 14:53:01 发布

酷毙的我啊

最新推荐文章于 2024-06-25 14:53:01 发布

阅读量347

点赞数

文章标签：爬取网页数据php

本文介绍了如何使用PHP和JavaScript结合来爬取网页内容。通过PHP模拟HTTP请求获取HTML，然后使用JavaScript进行数据处理。文章展示了具体的PHP代码片段和前端jQuery的Ajax请求示例，说明这种方法同样方便快捷，无需依赖Python的爬虫库。

摘要由CSDN通过智能技术生成

本篇文章给大家分享的内容是详细介绍PHP+JavaScript如何爬取网页内容，有着一定的参考价值，有需要的朋友可以参考一下

php+js爬取网页内容—–先看下效果

如何做到的呢？

我们一直以为只有Python才能爬取网页内容，那是因为Python本身集合很多类库用来爬取网页很方便，但是我们使用PHP+js的方法一样很方便，一样可以拿到我们想要的网页内容，而且也不用很繁琐。

首先我们需要PHP来模拟请求获取整个网站的HTML// 允许所有域访问

header("Access-Control-Allow-Origin: *");

/ 接收一个参数，参数名叫parm

$parm=$_GET['mod'];

if (empty($parm)) {

$url = 'http://m.80s.tw/';//目标网站

$html = file_get_contents($url);

}else{

$url = 'http://m.80s.tw/'.$parm;

$html = file_get_contents($url);

}

preg_match("/

]*?>(.*\s*?)/is",$html,$match1);//正则匹配body里面的内容

echo $match1[0];//输出网页注意：如果遇到 file_get_contents报错请尝试在 php.ini中找到extension=php_openssl.dll 开启就OK了

然后就是前端来获取数据进行处理了

首先写个异步请求$.ajax({

type:'get',

url: '.././admin/test.php',

success: function(data) {

console.log(data)//可以看到获取的HTML，很简单吧，很兴奋吧

}

});

获取HTML后我们就可以随心所欲了怎么来使用这些HTML呢？这是问题吗？不是//首先创建一个容器

var p = document.createElement('p');

// 把整个html的字符串存到这个p节点里

p.innerHTML = data;

//然后就可以对p一顿检查了

//比如获取类list_mov_title下所有的a标签

var list = p.querySelectorAll('.list_mov_title a');

//赶紧打印出来看一下

console.log(list)

//想要的东西都在吧

//然后就把想要的东西往自己的页面里面塞吧

一个爬取网页内容的教程就这样结束了，如果你豁然开朗了就转发一下吧，不明白的就留言吧

酷毙的我啊

关注

0
点赞
踩
1

收藏

觉得还不错? 一键收藏
0
评论
爬取网页数据php,详细介绍PHP+JavaScript如何爬取网页内容

本篇文章给大家分享的内容是详细介绍PHP+JavaScript如何爬取网页内容，有着一定的参考价值，有需要的朋友可以参考一下php+js爬取网页内容—–先看下效果如何做到的呢？我们一直以为只有Python才能爬取网页内容，那是因为Python本身集合很多类库用来爬取网页很方便，但是我们使用PHP+js的方法一样很方便，一样可以拿到我们想要的网页内容，而且也不用很繁琐。首先我们需要PHP来模拟请求获...
复制链接

扫一扫

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。