百度大脑UNIT3.0智能对话技术全面解析( 二 )

  (3)场景定制服务提升效果

  方案中自带基于百度大脑呼叫中心下的通用ASR、语义纠错,打断策略,TTS模型,也可以基于开发者的业务场景,提供模型定制训练服务,定向提升业务准确率 。

  (4)极少量开发,轻松实现对话流程

  提供Taskflow配置管理能力,开发者可在梳理业务流程后,通过少量代码快速配置对应的对话流程,后续可直接零代码在UNIT平台上进行拖拽式配置 。


百度大脑UNIT3.0智能对话技术全面解析

----百度大脑UNIT3.0智能对话技术全面解析//----

  【如何获取语音语义一体化能力】

  开发者可以进入UNIT官网——解决方案——语音语义一体化方案页面,了解技术详情并体验真实对话样例 。 https://ai.baidu.com/unit/v2/static/voice


百度大脑UNIT3.0智能对话技术全面解析

----百度大脑UNIT3.0智能对话技术全面解析//----

  体验真实对话样例


百度大脑UNIT3.0智能对话技术全面解析

----百度大脑UNIT3.0智能对话技术全面解析//----

  数据生产工具DataKit,大幅提升样本生产和标注效率

  在智能对话项目搭建的过程中,高效筛选、处理对话日志并将其转化为新的训练数据,是对话系统效果持续提升的重要环节,也是当前开发者面临的难题之一 。 为此UNIT推出学习反馈闭环机制,提供数据获取、辅助标注工具DataKit,帮助企业提升数据处理效率 。

  DataKit是面向开发者提供的数据生产工具集,利用交互式学习、规则样本生成和多模型一致性检验等技术方法自动获取大量数据,并从中筛选出带标注、半标注和无标注3类样本,这些样本经过高效的预处理后形成新的训练数据,可进一步提升语义解析效果,有效提升对话系统的优化人效 。

  【DataKit背后的技术】

  1. 交互式学习技术

  交互学习是以用户交互行为数据为基础,积累交互样本,解决系统效果瓶颈的迭代优化辅助方案 。 交互学习主要包含话术干预技术和异常样本发现技术 。

  2. 规则样本生成技术

  在UNIT平台上开发者可以方便地配置模板得到语义解析结果,实现语义解析的快速冷启动 。 在模板配置达到比较好的语义解析效果时,利用规则样本生成技术,产生带标注的样本集合进行深度训练,更进一步提升语义解析效果,有效降低人力投入 。

  3. 多模型一致性检验技术

  多模型一致性检验是日志挖掘的一种有效方法,检验UNIT上多个解析模型的结果,假设多个模型的解析结果越一致,其解析正确率越高 。 其中,具有高正确率的样本可以直接作为训练正例,解析为负例的样本可以直接作为负例,当前没有解析结果的样本可以进一步进行人工校验,不断优化解析效果 。


推荐阅读