清华图书馆机器人小图的“学习能力”是怎样实现的

之前没找到小图的网页,以为是一个实体的机器人呢。后来找到了:http://166.111.120.164:8081/programd/其实就是一个网络聊天机器人。测试了一下,感觉还不是很强大,语料库还不够丰富。修改一下之前的回答吧。这个没有研究过,猜测可能是利用了“专家系统”之类的算法。大概的步骤可能是这样的:(纯属个人基于目前知识猜测,不一定是这样实现的。)采集记者话语;——这一条不需要了,因为是直接输入的。进行初步滤波(filter),去除环境噪声等;——这一条也不需要了,纯文字,无污染。进行AD转换,将模拟形式的声波,转化成数字形式的音频;——不需要这么学术了,因为她没我想象的那么复杂。使用“模式识别”算法,识别人声,将单音节的人声转化成计算机的“语言”:例如,将听到的“你好”的声音,转变为计算机字符“你好”;——没有人声识别,不需要这步。对识别出来的语言,进行“分析”(parse):包括词法、语法分析,找到关键词,找到各种虚词(例如“的”“了”“啊”),还根据说话人的语调,分析知道其要表达的情绪;——基本上,是从这条开始适用的,不过也没有后半句的处理(语调分析)。语义分析:根须上一步的分析,知道人要说的话是什么意思;在这一点上也许用到了“专家系统”;从之前建立的“语料库”中取出一句可能相关的回答,这一点也可能用的是“专家系统”;利用Text-To-Speech一类的技术将取出的句子读出来。——因为没有适用语音技术,这一条变成了直接将取出的语料库中的话打印出来。恳请这方面的专家作答。---------------------------------------------------------------------------------------------------------------------------------补充:至于自我学习能力,估计就是把问话者的有意义的话,自动加入语料库中。可能运用了“自学习”相关的算法,不过估计他们还没有做到这个程度。
■网友
这个咱没人说详细点呢
■网友
就是状态机吧,有人训练的


    推荐阅读