【发布时间】:2011-12-23 07:37:39
【问题描述】:
我一直在尝试让一个词级语言模型在 lingpipe 上工作。我遇到的所有示例和教程都显示了 character-n-gram 模型。如何使用 lingpipe 训练单词级模型,然后使用该模型在其他文档上进行测试?
此外,我注意到 TokenizedLM 不可序列化。我有没有办法保存它并在以后加载它而不必每次都重新训练?
最后,是否有任何其他框架/工具可以让我在没有任何编码的情况下做到这一点?
【问题讨论】:
标签: java nlp classification document-classification