【发布时间】:2014-08-25 08:48:17
【问题描述】:
尝试解析 Te Reo Maori 中的单词时出现此错误
Pāngarau - 我假设它是宏
UnicodeEncodeError: 'ascii' 编解码器无法编码字符 u'\u0101'
关于如何解决这个问题的任何想法?
from lxml import html
import requests
page = requests.get('http://www.nzqa.govt.nz/qualifications-standards/qualifications/ncea/subjects/')
tree = html.fromstring(page.text)
text = tree.xpath('//*[@id="mainPage"]/table[1]/tbody/tr[1]/td[3]/a')
print text[0].text
Traceback(最近一次调用最后一次):
File "/Users/Teacher/Documents/Python/Standards/rip_html2.py", line 10, in <module>
print text[0].text
UnicodeEncodeError: 'ascii' codec can't encode character u'\u0101' in position 1: ordinal not in range(128)
[Finished in 0.5s with exit code 1]
【问题讨论】:
-
请贴出触发此错误的相关代码,无论是lxml相关方法。如果可能的话,也发布回溯。