【发布时间】:2013-08-19 05:44:37
【问题描述】:
我正在从网页读取页面源,然后从该源解析一个值。 在那里我遇到了特殊字符的问题。
在我的 python 控制器文件 iam 中使用 # -*- coding: utf-8 -*-。
但我正在阅读使用charset=iso-8859-1
所以当我在没有指定任何编码的情况下阅读页面内容时,它会抛出错误UnicodeDecodeError: 'utf8' codec can't decode byte 0xfc in position 133: invalid start byte
当我使用string.decode("iso-8859-1").encode("utf-8") 时,它正在解析数据而没有任何错误。但它将值显示为“F\u00fcnke”而不是“Fünke”。
请告诉我如何解决这个问题。 我将不胜感激任何建议。
【问题讨论】:
-
尝试打印
u"F\u00fcnke" -
Python 2 还是 3?
-
Python 2.7。并尝试 unicode() 它显示相同。