【发布时间】:2017-08-02 15:58:04
【问题描述】:
我有一个文本文件,其中包含单词列表及其形态分割:
例如:
瞄准:aim_V s:+PL, 瞄准:aim_V s:+3SG
航空公司air:air_N line:line_N
alarm的闹钟:alarm_N's:+GEN
炼金术士 alchem:alchemy_Nist:ist_s s:+PL
我想在 Python 中将这个文本文件转换为二维数组,其中第一维是单词,第二维是表示单词形态分割的字符串
例如对于“航空公司”这个词,形态分割应该是 BMEBMME,其中:
- B 是变形的开始
- M 是变形的中间字符
- E 是变形的结尾
我们还有代表单字符变形的 S,例如对于“目标”,我们将 BMES 作为其形态分割。
单词已经在一行的右侧被分割成变形。
非常感谢您的帮助:)
【问题讨论】:
-
是“目标”BMEB 的形态分割吗?
-
对不起,我错过了代表单字符变形的 S
-
所以目标将是 BMES
-
嗯,有趣的问题!我会考虑的。
-
好的,谢谢!我正在尝试在行右侧的形态分割中使用“:”符号之前的字符
标签: python arrays text-files