【发布时间】:2017-03-30 18:49:26
【问题描述】:
似乎有很多关于在其他语言中执行此操作的帖子,但我似乎无法弄清楚在 Python 中如何(我使用的是 2.7)。
明确地说,我希望将字符串保留为 unicode,只是能够替换某些特定字符。
例如:
thisToken = u'tandh\u2013bm'
print(thisToken)
打印中间有 m 破折号的单词。我只想删除 m-dash。 (但不使用索引,因为我希望能够在任何找到这些特定字符的地方执行此操作。)
我尝试使用replace,就像你对任何其他角色一样:
newToke = thisToken.replace('\u2013','')
print(newToke)
但它只是不起作用。任何帮助深表感谢。 赛斯
【问题讨论】:
-
如果你在文件的顶部使用
from __future__ import unicode_literals,所有的字符串文字都是自动的unicode,它在这里会有所帮助(但是当一些字符串需要是字节时要小心意外,你可以为它们使用b前缀)。
标签: python python-2.7 unicode