【发布时间】:2019-12-20 12:53:14
【问题描述】:
我在 LUIS 文档页面 here 上看到,您绝对建议将数据不平衡(例如,在各种意图之间比较的总不平衡数不同)作为首要任务。目前,我们在仪表板上看到每个 Intent 平均有 19 个 Utterance,因此我认为我应该优化所有 Intent,使其每个 Intent 大约有 20 个 Utterance。
现在我的问题是:当我通过添加端点话语来使用主动学习时,话语将被添加到我们认为合适的意图中 (Active Learning Documentation)。我如何确保每个意图的话语数量始终保持相等(例如,在我们的示例中约为 20 个)?在我看来,通过将端点话语归因于 Intent,自然会再次创建数据不平衡。
非常感谢!
最好, 标记
【问题讨论】:
标签: botframework azure-language-understanding