【发布时间】:2013-01-20 06:37:17
【问题描述】:
我目前正在开发一个程序,该程序将平均 Amazon 上搜索项目的价格。
我在程序上有一个按钮,当按下该按钮时,会将HTML 源代码打印到richtextbox 中,然后在源代码中找到特定的div。
我现在唯一的问题是在每个div 之后打印出金额。
有什么办法吗?
【问题讨论】:
标签: vb.net visual-studio-2010 html html-parsing
我目前正在开发一个程序,该程序将平均 Amazon 上搜索项目的价格。
我在程序上有一个按钮,当按下该按钮时,会将HTML 源代码打印到richtextbox 中,然后在源代码中找到特定的div。
我现在唯一的问题是在每个div 之后打印出金额。
有什么办法吗?
【问题讨论】:
标签: vb.net visual-studio-2010 html html-parsing
您可以使用 HTMLAgilityPack,这是最好的 HTML 解析库之一来简化此任务。 一个example。
示例:
假设 div 的 id 是 divPrice
HtmlDocument doc = new HtmlDocument();
doc.LoadHtml(yourHTML);
HtmlNode priceNode = doc.GetElementbyId("divPrice");
string price = priceNode.InnerText;
假设div没有id只有一个css类cssPrice,那么你可以用XPath查询:
HtmlNode priceNode = doc.DocumentNode.SelectSingleNode("//div[@class='cssPrice']");
或
HtmlNodeCollection nodes = doc.DocumentNode.SelectNodes("//div[@class='cssPrice']");
foreach (HtmlNode node in nodes) {
string nodeText = node.InnerText;
}
【讨论】: