【发布时间】:2021-12-11 13:08:45
【问题描述】:
我必须从随机文本中识别国家名称。我有国家名单。
我正在努力寻找可以在国家/地区列表上训练模型的解决方案,当我向该模型提供随机文本作为输入时,它会将国家名称标识为输出。
例如:-
- “我住在印度”将给出“印度”
- “伦敦是英国的首都”将给出“英国”
提前致谢。
【问题讨论】:
-
这听起来很像 SpaCy
标签: nlp text-extraction
我必须从随机文本中识别国家名称。我有国家名单。
我正在努力寻找可以在国家/地区列表上训练模型的解决方案,当我向该模型提供随机文本作为输入时,它会将国家名称标识为输出。
例如:-
提前致谢。
【问题讨论】:
标签: nlp text-extraction
在这种情况下,您似乎正在匹配文本。为什么需要模型?似乎有点矫枉过正。
如果你有国家列表,你应该规范化文本
https://www.geeksforgeeks.org/normalizing-textual-data-with-python/
然后你可以搜索文本中的国家。
https://www.dummies.com/programming/python/how-to-search-within-a-string-in-python/
您可以使用某些技术进行匹配,例如 levestein 距离,但我认为有必要为此建立一个模型。
【讨论】: