菜鸟入门:C#htmlparser的配置与使用。

1 。配置

先下载C#的htmlparser包(Winistaparser)。及说明见我CSDN的资源空间。VS2005下项目->添加引用->浏览(找到)Winistaparser/bin/debug/winstahtmlparser.dll添加即可。

2。练习使用

快速入门教程见http://www.zhangyongjun.com/blog/article.asp?id=226;

代码实例如下如下:

 

using System;
using System.Collections.Generic;
using System.Text;
using Winista.Text.HtmlParser.Visitors;
using Winista.Text.HtmlParser;
using Winista.Text.HtmlParser.Util;//包含ParserException
using Winista.Text.HtmlParser.Filters;
using Winista.Text.HtmlParser.Tags;

namespace ConsoleApplication9
{
    class Program
    {
        static void Main(string[] args)
        {
            string htmlcode = "<html><head><title>AAA</title><a href=/"http://www.ent.qq.com/">腾讯娱乐</a></head><body><a href=/"http://www.news.qq.com/">腾讯新闻</a><a href=/"http://www.edu.qq.com/">腾讯教育</a></body></html>";
            Parser parser = Parser.CreateParser(htmlcode,"GBK");//用页面string 做一个parser;
           
            HtmlPage page = new HtmlPage(parser);//用这个parser做一个visitor
            try { parser.VisitAllNodesWith(page); }
            catch (ParserException e1) { e1 = null; }
            NodeList nodelist = page.Body;//body元素中的节点列表
            NodeFilter nodefilter = new TagNameFilter("A");//建立过滤器
            nodelist = nodelist.ExtractAllNodesThatMatch(nodefilter, true);//返回其中的A节点列表
            for (int i = 0; i < nodelist.Size(); i++)
            {
                ATag link = (ATag)nodelist.ElementAt(i);
                Console.Write(link.GetAttribute("href")+"/n");
            }
            Console.Read();
               

        }
    }
}

我的入门资料+C#htmlparser请到下载中心finallyliuyu的资源。

  • 0
    点赞
  • 3
    收藏
    觉得还不错? 一键收藏
  • 1
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论 1
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值