HtmlAgilityPack属性获取
//若需要抓取的节点有ID,类似“<div id='post_list'>value</div>”这种,那很简单只需调⽤GetElementbyId⽅法根据节点ID即可获取所需节点。从⽽通过HtmlNode中的InnerText或Attribute属性来获取你想要的值。
//实例化HtmlAgilityPack.HtmlDocument对象
HtmlDocument doc = new HtmlDocument();
//载⼊HTML
doc.LoadHtml(str);
//根据HTML节点NODE的ID获取节点
HtmlNode navNode = doc.GetElementbyId("post_list");
其他可能有⽤的技术点:
1、获取⽹页title:doc.DocumentNode.SelectSingleNode("//title").InnerText;
解释:XPath中“//title”表⽰所有title节点。SelectSingleNode⽤于获取满⾜条件的唯⼀的节点。
2、获取所有的超链接:doc.DocumentNode.Descendants("a")
3、获取name为kw的input,也就是相当于getElementsByName():
html document是什么var kwBox = doc.DocumentNode.SelectSingleNode("//input[@name='kw']");
//若需要抓取的节点有ID,类似“<div id='post_list'>value</div>”这种,那很简单只需调⽤GetElementbyId⽅法根据节点ID即可获取所需节点。从⽽通过HtmlNode中的InnerText或Attribute属性来获取你想要的值。
版权声明:本站内容均来自互联网,仅供演示用,请勿用于商业和其他非法用途。如果侵犯了您的权益请与我们联系QQ:729038198,我们将在24小时内删除。
发表评论