【发布时间】:2011-08-03 18:48:38
【问题描述】:
场景:
我需要解析数百万个 HTML 文件/页面(尽我所能)然后只读取其中的标题或元部分并将其转储到数据库
我正在做的是使用System.Net.WebClient 类的DownloadString(url_path) 下载然后通过 LINQ To SQL 将其保存到数据库
但是这个DownloadString函数给了我完整的html源代码,我只需要标题部分和META标签部分。
有什么想法,只下载这么多内容吗?
【问题讨论】:
标签: c# .net asp.net html webclient