【问题标题】:Entity over-generalisation on Api.aiApi.ai 上的实体过度泛化
【发布时间】:2017-08-31 05:40:04
【问题描述】:

我们在 Api.ai 上过度概括聊天机器人实体时遇到了很大的困难,即在自定义实体上使用“定义同义词”功能时返回尚未为该实体指定的值,即使当“允许自动扩展”标志已关闭。

我们的关键示例是用于确认用户选择的实体,称为确认接受。我们有一个条目:“就是这样”,同义词:“就是这样”,“就是这样”,“就是这样,谢谢”,“就是这样,谢谢”,“就是这样,谢谢”。该实体值在仅出现一个杂散“它”的表达式中意外返回。

一般来说,我们已经看到了很多不恰当的实体概括,这似乎表明在实体识别过程中存在某种形式的停用词删除和词干提取/词形还原……并且无法关闭。

这会返回较差的实体分类,从而难以创建对非常精确的值很重要的实体,例如其中一个单词或字符可以在含义上产生很大的不同。我们的关键用例涉及大量地址处理,因此我们只取回我们指定的值很重要。

我们看到的过度概括的类型包括:

  • 不恰当地将限定词(a、an、the、this、that 等)识别为实体的一部分:如“it”返回“that's it”
  • 词干:如“driving”的杂散提及,返回“drive”(一个有效的街道类型实体)
  • 不恰当的复数词干:“children”返回“child”,或者“wills”返回“wills”(在我们的例子中,“child”和“wills”是街道名称实体,所以我们不不希望“孩子”或“将”被退回)

这使得使用 Api.ai 服务创建生产质量聊天机器人变得困难。

在获得 Api.ai 的响应或解决过度泛化问题方面,有谁更幸运?

【问题讨论】:

    标签: nlp dialogflow-es


    【解决方案1】:

    实体旨在从对话中提取信息: API.AI 的实体旨在用于从对话输入中提取数据解析不同的短语和词性。对于您的示例(that’s itthats itthat is itthat’s it thanksthats it thanksthat is it thanks)似乎都表明用户的意图是表明来自 API.AI 代理的最后一条消息是正确的。对于此类实例,最好将这些短语用作意图或现有意图的示例,而其他响应则表明用户希望表明上一个响应是正确的。

    API.AI 自动捕获实体时态和复数:解决您的其他问题(driving 实体,返回 drive 值,children 返回 child,或 wills 返回wills):API.AI 有意捕获实体的不同时态和复数形式,以便为许多不知道您在数据库中输入的确切实体的用户提供更好的体验。这允许您的会话应用程序的用户与您的用户进行自然对话,而不需要精确的措辞或

    【讨论】:

      猜你喜欢
      • 2017-05-05
      • 1970-01-01
      • 1970-01-01
      • 2012-06-30
      • 2017-10-01
      • 1970-01-01
      • 1970-01-01
      • 2015-06-07
      • 1970-01-01
      相关资源
      最近更新 更多