语音合成(tts):经过将大肆文本变换针言音,实行电话山东十一选五谈话本领。语音合成流利度和逼近真人发音不妨明显提高山东十一选五仿真度。
语音辨别(asr):将语音旗号翻译成笔墨消息。语音转写的透彻度确定山东十一选五的脑力,最后感化山东十一选五的才华。
人机交互经过率(hrir):表领会存户和山东十一选五沟经过程中,山东十一选五精确相应直到结果一轮交互的精确经过率。经过率=c/n*100%(c精确经过的总通数;n拨号电话的总通数),人工交互经过率越高表白系统越逼近于人的确定,可费用越高;
谈话模子(language model):谈话模子是对一组字序列形成的常识表白;谈话模子的目的是在语音辨别的进程中灵验地贯串语法和语义的常识。
声学模子(acoustic model):声学模子是对声学、语音学、情况的变量、谈话人情别、口音等的分别的常识表白;声学模子的目的是供给一种灵验的本领,计划语音的特性矢量序列和每个发音沙盘之间的隔绝。
语音震动检验和测定(voice activity detection,vad)模子:重要功效是用来设定山东十一选五发端辨别和中断检验和测定并辨别存户声响功夫点,以实行呆板及时赶快并精确的相应存户回复的需要。
交互:山东十一选五与存户勾通的进程即为交互。
交互轮数:话术中山东十一选五和存户交互的度数,也即是,山东十一选五和存户有几次互动。
话术:山东十一选五控制与以电话呼入、外呼贯穿的用户举行电话智能交互,交互的进程不妨举行摆设,该摆设称之为话术;也不妨大略的领会为,呆板与存户交互进程中所说的话。
出口场景:每个节点预设的存户回复山东十一选五题目的各别典型称之为出口场景。
场景掩盖率:每个节点预设出口场景的个数与存户本质出口场景的个数之比。场景掩盖率越高,证明山东十一选五与存户交互越成功。
节点:话术中山东十一选五谈话局部的统称。
基线模子:谈话模子中山东十一选五的第一版辨别模子。字转写精确度的提高,即是在基线模子的普通上跟着语言材料的连接减少渐渐优化提高模子精确度的。
语言材料:是指山东十一选五与存户交互进程中,存户的说的话。
要害词:是指鉴于存户说的话,有益于提高山东十一选五辨别精确度的要害表白。
外显号子:是指山东十一选五外呼给存户,存户大哥大上表露的复电号子。
呼通率:是指山东十一选五外呼电话,截止呼通的电话量占一切外呼电话量的百分比。
精分通话截止:是指山东十一选五外呼电话,最后能否通话胜利以及未呼通时,存户大哥大的检验和测定状况细分。
发音人:山东十一选五的声响须要按照各别场景定制各别的发音。
动静消息:是指在山东十一选五话术中,按照各别存户播报的消息不一律的消息。
提醒音:是指山东十一选五话术的人工灌音。
合成音:是指电话山东十一选五话术的呆板在线合成的声响。