【发布时间】:2013-09-08 02:46:40
【问题描述】:
我正在尝试使用带有以下代码的 API 获取维基百科的内容(保加利亚语):
$content = file_get_contents("http://bg.wikipedia.org/w/api.php?format=json&action=query&titles=%D0%A1%D0%BE%D1%84%D0%B8%D1%8F&prop=revisions&rvprop=content");
问题是结果看起来像这样:
........."*":"{{\u043a\u044a\u043c \u043f\u043e\u044f\u0441\u043d\u0435\u043d\u0438\u0435|\u0421\u043e\u0444\u0438\u044f|\u0421\u043e\u0444\u0438\u044f (\u043f\u043e\u044f\u0441\u043d\u0435\u043d\u0438\u0435)}}\n{{\u0421\u0435\u043b\u0438\u0449\u0435 \u0432 \u0411\u044a\u043b\u0433\u0430\u0440\u0438\u044f\n|
即使我在浏览器中打开链接,我也会得到这个结果。如果我将 JSON 更改为 XML,效果很好,但如果格式为 JSON,则内容“不可读”。
如何获得可读的文本?或者有没有其他简单的解决方案来解析来自维基百科的段落?
【问题讨论】:
-
那些是转义的 unicode 字符。如果你将 JSON 解析成一个对象,它看起来会很好。
标签: php json api parsing wikipedia