【发布时间】:2010-12-24 22:03:44
【问题描述】:
我正在研究一种接受字符串(html 代码)并返回包含 in 中包含的所有链接的数组的方法。
我已经看到了一些选项,例如 html 能力包,但它似乎比这个项目要求的要复杂一些
我也对使用正则表达式感兴趣,因为我没有太多的经验,我认为这将是一个很好的学习机会。
到目前为止我的代码是
WebClient client = new WebClient();
string htmlCode = client.DownloadString(p);
Regex exp = new Regex(@"http://(www\.)?([^\.]+)\.com", RegexOptions.IgnoreCase);
string[] test = exp.Split(htmlCode);
但我没有得到我想要的结果,因为我仍在处理正则表达式
我正在寻找的 sudo 代码是“
【问题讨论】:
-
虽然不是答案,但这可能是您学习正则表达式时想要使用的工具:rubular.com
-
由于我们提供有用的自学正则表达式工具,我想说我是The Regex Coach 的忠实粉丝。它看起来比 Rubular 功能更丰富(单步执行和树功能特别有用),但显然需要下载和安装,而不是基于浏览器。
标签: c# html regex parsing hyperlink