【发布时间】:2016-07-08 12:27:13
【问题描述】:
我在 python 2.7 中使用 elasticsearch。我必须分析和存储大量文本;经常出现如下错误: SyntaxError: 非 ASCII 字符 ... 我编写了以下代码进行测试:
import elasticsearch
es = elasticsearch.Elasticsearch("127.0.0.1:9200")
test = 'sarà'
doc = {
'ID':'123456',
'field':unicode(test, errors='ignore'),
}
es.index('test_db','test',doc)
错误是:
语法错误:文件 /home/user/PycharmProjects/ubuntu/asciiTest.py 第 4 行中的非 ASCII 字符“\xc3”,但未声明编码。
在阅读了关于 stackoverflow 的其他答案后,我尝试了:
unicode(test, errors='ignore')
但又是同样的错误。我不知道如何管理这些特殊字符。
【问题讨论】:
标签: python-2.7 elasticsearch character-encoding non-ascii-characters python-unicode