【发布时间】:2011-09-28 19:33:37
【问题描述】:
当我在一堆 URL 上运行循环以查找这些页面上的所有链接(在某些 Div 中)时,我得到了这个错误:
Traceback (most recent call last):
File "file_location", line 38, in <module>
out.writerow(tag['href'])
UnicodeEncodeError: 'ascii' codec can't encode character u'\u2026' in position 0: ordinal not in range(128)
我写的与这个错误相关的代码是:
out = csv.writer(open("file_location", "ab"), delimiter=";")
for tag in soup_3.findAll('a', href=True):
out.writerow(tag['href'])
有没有办法解决这个问题,可能使用 if 语句来忽略任何有 Unicode 错误的 URL?
提前感谢您的帮助。
【问题讨论】: