【发布时间】:2015-06-12 14:57:43
【问题描述】:
如果我使用带有unichr(orninal) 的序号打印一个字符,并且序号位置不包含任何有效字符,结果将是:
>>> print unichr(0x0c80)
ಀ
现在我想从字符串中过滤出这样的空字符,我尝试str.encode('utf-8', errors='ignore') 为:
>>> print ''.join([unichr(i) for i in range(0x0c80, 0x0cff)]).encode('utf-8', errors='ignore')
ಀಁಂಃ಄ಅಆಇಈಉಊಋಌಎಏಐಒಓಔಕಖಗಘಙಚಛಜಝಞಟಠಡಢಣತಥದಧನಪಫಬಭಮಯರಱಲಳವಶಷಸಹ಼ಽಾಿೀುೂೃೄೆೇೈೊೋೌ್ೕೖೝೞೠೡೢೣ೦೧೨೩೪೫೬೭೮೯ೱೲೳ
但空字符仍然存在。有没有办法过滤这些字符?
【问题讨论】:
-
您提出的问题比您想象的要复杂得多。那不是“空字符”。它只是一个字符,您安装的所有字体都没有可用的字形。 “字符”本身既不是无效也不是“空”,代码点可能根本不被使用。
标签: string python-2.7 unicode