这是个很好的的东西,以前做Html解析都是在用htmlparser,用的虽然顺手,但解析速度较慢,碰巧今天找到了这个,就拿过来试,一切出乎意料,非常爽,推荐给各位使用。
下面是一些简单的使用技巧,希望对大家有用,我个人也是个学习过程。
Why Html Agility Pack? (以下简称HAP)
.Net下解析HTML文件有很多种选择,包括微软自己也提供MSHTML用于manipulate HTML文件。但是,经过我一段时间的搜索,Html Agility Pack浮出水面:它是Stackoverflow网站上推荐最多的C# HTML解析器。HAP开源,易用,解析速度快。
How to use HAP?
1. 下载http://htmlagilitypack.codeplex.com/
2. 解压
3. 在Visual Studio Solution里,右击project -> add reference -> 选择解压文件夹里的HTMLAgilityPack.dll -> 确定
4. 代码头部加入 using HtmlAgilityPack;
Done!
HtmlWeb webClient = new HtmlWeb();
HtmlDocument doc = webClient.Load("http://xxx/");
HtmlNodeCollection hrefList = doc.DocumentNode.SelectNodes(".//a[@href]");
if (hrefList != null)
{
foreach (HtmlNode href in hrefList)
{
HtmlAttribute att = href.Attribu

Html Agility Pack(HAP)是.NET下流行的HTML解析器,因其开源、易用和速度而受到推荐。通过下载、引用DLL,可以方便地在项目中使用。本文介绍了如何根据ID选择节点、在HTML树中查找节点、获取节点ID以及处理字符串中的HTML等内容,帮助开发者更好地利用HAP处理HTML文档。
3105

被折叠的 条评论
为什么被折叠?



