抓取页面html,抓取其他页面的HTML，非源码

最新推荐文章于 2021-11-11 10:44:02 发布

文刀木之南

最新推荐文章于 2021-11-11 10:44:02 发布

阅读量230

点赞数

文章标签：抓取页面html

后台代码如下：

string url = "http://baoliao.cq.qq.com/pc/detail.html?id=443758s";

HttpWebRequest request = (HttpWebRequest)WebRequest.Create(url);

request.Accept = "*/*"; //接受任意文件

request.UserAgent = "Mozilla/4.0 (compatible; MSIE 6.0; Windows NT 5.2; .NET CLR 1.1.4322)"; //

request.AllowAutoRedirect = true;//是否允许302

request.Referer = url; //当前页面的引用

HttpWebResponse response = (HttpWebResponse)request.GetResponse();

Stream stream = response.GetResponseStream();

StreamReader reader = new StreamReader(stream, Encoding.GetEncoding("utf-8"));

html = reader.ReadToEnd();

stream.Close();

text.Text = html;

如题，asp.net 抓取页面内容，如http://baoliao.cq.qq.com/pc/detail.html?id=443758这个网站的内容，其他页面的抓取都没问题，这个网站好像有点特殊，他只能抓取到页面的源代码，但不能抓取到整个HTML，各位大神也可以打开这网站的源码，也找不到内容主体。但HTML有内容主体，求解，怎么抓取到内容主体。

文刀木之南

关注

0
点赞
踩
1

收藏

觉得还不错? 一键收藏
0
评论
抓取页面html,抓取其他页面的HTML，非源码

后台代码如下：string url = "http://baoliao.cq.qq.com/pc/detail.html?id=443758s";HttpWebRequest request = (HttpWebRequest)WebRequest.Create(url);request.Accept = "*/*"; //接受任意文件request.UserAgent = "Mozilla/4....
复制链接

扫一扫

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。