【发布时间】:2014-07-07 15:39:41
【问题描述】:
我正在开发一个使用 crawler4j 和 Jsoup 来抓取网络的应用程序。我需要使用 JSoup 解析网页并检查它是否有 zip 文件、pdf/doc 和 mp3/mov 文件可作为下载资源。
对于 zip 文件,我做了以下操作:
Elements zip = doc.select("a[href\$=.zip]")
println "No of zip files is " + zip.size()
此代码正确地告诉我一个页面中有多少个 zip 文件。我不确定如何使用 JSoup 计算所有音频文件或文档文件。任何帮助表示赞赏。谢谢。
【问题讨论】:
标签: grails groovy jsoup crawler4j