【发布时间】:2017-02-27 16:10:30
【问题描述】:
假设我们有一个单词列表 L1={好,真棒,坏,超级,玩具,山}和一个 string S="这是一个好人写的很棒的台词。". 当我们映射这两个时,我们需要找到相似词的数量。 在这种情况下,它的 2(好,真棒) 请帮助我如何在python中解决这个问题。 PS:我正在尝试根据列表和字符串之间单词的相似性为机器学习子任务创建一个二进制响应变量, 我是自然语言处理的新手,有什么功能可以轻松做到这一点吗?
PS: 我尝试首先拆分字符串并将单个单词存储在列表中,然后对其进行迭代并与原始单词列表进行比较,并在找到匹配项时增加计数器。
在 NLP 中有没有直接的函数可以做到这一点?
【问题讨论】:
-
在我的项目中? @depperm
-
@AmireddyTharunreddy 对于这个特定的任务。你做过研究吗?你自己试过吗?
-
@Mitch 我尝试通过首先拆分字符串并将其存储在一个列表中,然后对其进行迭代并与原始列表进行比较,并在找到匹配项时增加计数器。我的问题是如何降低复杂性,或者这些是完成任务的直接功能吗?
标签: python algorithm machine-learning nlp