【问题标题】:NLP - Specific Text ExtractionNLP - 特定文本提取
【发布时间】:2021-12-11 13:08:45
【问题描述】:

我必须从随机文本中识别国家名称。我有国家名单。

我正在努力寻找可以在国家/地区列表上训练模型的解决方案,当我向该模型提供随机文本作为输入时,它会将国家名称标识为输出。

例如:-

  • “我住在印度”将给出“印度”
  • “伦敦是英国的首都”将给出“英国”

提前致谢。

【问题讨论】:

  • 这听起来很像 SpaCy

标签: nlp text-extraction


【解决方案1】:

在这种情况下,您似乎正在匹配文本。为什么需要模型?似乎有点矫枉过正。

如果你有国家列表,你应该规范化文本

https://www.geeksforgeeks.org/normalizing-textual-data-with-python/

然后你可以搜索文本中的国家。

https://www.dummies.com/programming/python/how-to-search-within-a-string-in-python/

您可以使用某些技术进行匹配,例如 levestein 距离,但我认为有必要为此建立一个模型。

【讨论】:

  • 嗨 miguelik,实际上我已经举了一个非常开心的案例作为例子。文本也可以是:LoadingIndiaPorts 的国家,也可能是 Indiia 等拼写错误
猜你喜欢
  • 2019-12-18
  • 2017-06-21
  • 2019-05-26
  • 1970-01-01
  • 2012-01-01
  • 1970-01-01
  • 1970-01-01
  • 2019-06-23
  • 1970-01-01
相关资源
最近更新 更多