【发布时间】:2018-10-06 14:31:32
【问题描述】:
在我的应用程序中,我在文本文件中列出了(乌尔都语)单词,(目前是这样的单个单词)
我还有另一个包含 urdu 字符串的文本文件(目前是这样的单个单词并且完全相同)
现在我需要查找字符串文件的字符串是否包含单词文件中存在的任何单词。为此,我将这两个文件都读入这样的列表中;
// 读取字符串的文本文件...
fileToRead = codecs.open('string.txt', mode, encoding=encoding)
fileData = fileToRead.read()
lstFileData = fileData.split('\n')
wordListToRead = codecs.open('words.txt', mode, encoding=encoding)
wordData = wordListToRead.read()
lstWords = wordData.split('\n')
我只是像这样遍历列表;
for string in lstFileData:
if string in lstWords:
// do further work
它不工作而且我不知道为什么?虽然字符串是 'فلسفے' 并且 lstWords 中有这个字符串。我需要添加一些编码吗?任何形式的帮助将不胜感激。
【问题讨论】:
-
它应该可以正常工作,您最好添加更多代码
-
好的,让我详细补充一下。
-
请检查更新的问题
标签: python python-3.x unicode utf-8 urdu