【问题标题】:Converging extracted sentences and counting predicted label for each paragraph收敛提取的句子并计算每个段落的预测标签
【发布时间】:2019-08-28 16:06:47
【问题描述】:

我遇到了 knime 问题。我在 excel 文件中有一些段落,我想找出每个段落中有多少句子是自信的、陈述性的。所以,我有一个带有标签句子的数据集。我已经在该数据集上建立了一个模型。现在,我使用该数据集通过 SentenceExtractor 节点预测段落的句子,并应用模型和模型给出预测。现在,问题是预测是关于句子的,我需要知道每段中有多少句子是自信的,等等。我应该如何加入提取的段落句子并计算每个段落句子的预测并将它们记录到excel文件中?

任何帮助将不胜感激。

我已经尝试过 rowID 和 groupBy 节点。但是我做不到

【问题讨论】:

    标签: java knime


    【解决方案1】:

    您应该使用 Pivoting 节点。组列应该是标签(列)哪个句子属于哪个段落,枢轴列是您的预测列,聚合方法是在任何其他列上计数。

    【讨论】:

    • 谢谢。我现在真的很理解你,但最后一个问题。我怎么知道哪个句子属于哪个段落?这是我们在拆分成句子之前要做的事情吗?
    • 尝试将您的预测与句子提取器节点的输出结合起来,例如,因为您有相同数量的行。然后从那里你应该通过从文档中提取一个(也许更好以确保是唯一的)第一个单词来定义你的段落。然后使用 Pivoting 节点将为您提供每段的句子数。
    猜你喜欢
    • 2015-06-02
    • 2014-02-26
    • 1970-01-01
    • 2020-01-22
    • 2021-04-30
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多