【问题标题】:Non-ASCII character error using nltk in Python在 Python 中使用 nltk 的非 ASCII 字符错误
【发布时间】:2016-06-19 01:04:14
【问题描述】:

我正在尝试使用以下链接中给出的解决方案代码:Unicode Tagging in Python NLTK

omerbp给出的解决方案中:

from nltk.corpus import indian
from nltk.tag import tnt

train_data = indian.tagged_sents('hindi.pos')
tnt_pos_tagger = tnt.TnT()
tnt_pos_tagger.train(train_data) #Training the tnt Part of speech tagger with hindi data

print tnt_pos_tagger.tag(nltk.word_tokenize(word_to_be_tagged))

我收到以下错误:

'SyntaxError: Non-ASCII character '\xe0' in file q12.py on line 1,但未声明编码;详情见http://www.python.org/peps/pep-0263.html第1行。

【问题讨论】:

标签: python ascii nltk


【解决方案1】:

在文件顶部添加这两行:

#!/usr/bin/python
# -*- coding: utf-8 -*-

他们将指示解释器将每个字符编码为 UTF-8 而不是 ASCII。

【讨论】:

    猜你喜欢
    • 2014-12-06
    • 2015-01-06
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2014-03-05
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多