【问题标题】:How to do stemmization of Telugu using Java Lucene?如何使用 Java Lucene 对泰卢固语进行词干化?
【发布时间】:2019-04-28 19:22:10
【问题描述】:

如何使用 Java Lucene 对 Telugu 语言进行词干化

【问题讨论】:

    标签: lucene nlp tokenize information-retrieval


    【解决方案1】:

    不幸的是,泰卢固语没有内置的词干分析器(就像印地语一样)。这意味着,如果您想做一些泰卢固语词干提取,您需要自己实现这个组件。

    好的起点是看看这个presentation 并将这些技术整合到Lucene TokenFilter 中。

    编写自定义 TokenFilter 并不像看起来那么难。你可以看看例子here

    【讨论】:

      猜你喜欢
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2017-11-27
      • 1970-01-01
      • 1970-01-01
      • 2015-05-07
      • 1970-01-01
      • 1970-01-01
      相关资源
      最近更新 更多