新天地彩票注册

AI语音交互领域常用的4个术语

作者:华一汽车科技    来源:www.fg2388com.com    发布时间:2019-12-20 12:17    阅读:次

语音交互是基于语音输入的新一代交互模式,比较典型的应用场景是各类语音助手。
 
本文整理了语音交互领域常用的4个术语,希望可以帮助大家更好地理解这门学科。
 
语音交互
 
1、语音合成标记语言(SSML)
语音合成标记语言的英文全称是Speech Synthesis Markup Language,这是一种基于XML的标记语言,可让开发人员指定如何使用文本转语音服务将输入文本转换为合成语音。
 
与纯文本相比,SSML可让开发人员微调音节、发音、语速、音量以及文本转语音输出的其他属性。
 
SSML可自动处理正常的停顿(例如,在句号后面暂停片刻),或者在以问号结尾的句子中使用正确的音调。
 
2、语音识别技术(ASR)
若要实现机器与人类的对话,就要经过三个步骤:听懂、理解与回答。语音标注技术的目标就是将人类语音中的词汇内容转换为计算机可读的输入。
 
语音识别技术可分为以下四个流程:
 
语音识别技术
 
目前,手机里的语音助手是语音识别技术最典型的应用之一。
 
3、音素(phone)
音素是根据语音的自然属性划分出来的最小语音单位,通俗点来说其实就是人在说话时,能发出最最最最短小、简洁的不能再分割的发音。不同的音素就是不同的短发音,可以组成不同的长发音,再组成词句形成语言。
 
4、语音合成(TTS)
语音合成是通过机械的、电子的方法产生人造语音的技术。通俗点来说,语音合成就是让机器模仿人类说话。即输入一段文字,最终输出一段语音。
 
语音合成技术目前主要应用在读书软件、导航软件、对话问答系统等领域。


 

文章转载请保留原文网址:http://www.fg2388com.com/news/hyzx/1025.html


上一篇:智能化大趋势下:汽车主动交互设计应用

下一篇:认识ADAS高级驾驶辅助系统


液晶仪表 返回列表
 赖子棋牌 龙猫彩票开户 星乐彩票注册 河北快3代理 广西快3 云谷彩票开户 周易彩票开户 众盈彩票投注 贵州快3计划 助赢彩票开户