【发布时间】:2011-02-19 18:05:13
【问题描述】:
我已经创建了自己的 DefaultHandler 来解析 rss 提要,并且对于大多数提要来说它工作正常,但是,对于 ESPN,由于 ESPN 格式化它的 url 的方式,它正在切断部分文章 url。来自 ESPN 的完整文章 URL 示例。
http://sports.espn.go.com/nba/news/story?id=5189101&campaign=rss&source=ESPNHeadlines
问题是由于某种原因 DefaultHandler 字符方法只能从包含上述 url 的标签中获取。
http://sports.espn.go.com/nba/news/story?id=5189101
如您所见,它从 & 转义码和之后的 URL 中删除了所有内容。如何让 SAX 解析器在这个转义码处不切断我的字符串?对于参考。这是我的字符方法..
public void characters(char ch[], int start, int length) {
String chars = (new String(ch).substring(start, start + length));
try {
// If not in item, then title/link refers to feed
if (!inItem) {
if (inTitle)
currentFeed.title = chars;
} else {
if (inLink)
currentArticle.url = new URL(chars);
if (inTitle)
currentArticle.title = chars;
if (inDescription)
currentArticle.description = chars;
if (inPubDate)
currentArticle.pubDate = chars;
if (inEnclosure) {
}
}
} catch (MalformedURLException e) {
Log.e("RSSReader", e.toString());
}
}
罗伯·W.
【问题讨论】:
标签: android parsing escaping sax