【发布时间】:2011-06-03 17:58:18
【问题描述】:
作为一个学习练习,我正在用 Common Lisp 编写一个网络爬虫。 (粗略的)计划是:
我刚刚遇到了一个症结:我正在抓取的网站并不总是生成有效的 XHTML。这意味着第 3 步(使用 xml 解析页面)不起作用。而且我像this guy 一样不愿意使用正则表达式:-)
那么,谁能推荐一个用于解析无效 XHTML 的 Common Lisp 包?我正在想象类似于 .NET 的 HTML Agility Pack ...
【问题讨论】:
标签: common-lisp web-scraping quicklisp