站搜网12月27日消息 谷歌近日开创性地推出了一款全新的文字转语音系统,名为Tacotron 2,它具有惊人的发音准确性,能够提供与真人声音几乎无法区分开来的发音。据悉Tacotron 2已经是第二代技术,它由两个深度神经网络组成,一个将文本转换为特殊的图谱(如上图所示),第二个是WaveNet,会读取这个图谱并将其还原为一个真实的声音
站搜网12月27日消息 谷歌近日开创性地推出了一款全新的文字转语音系统,名为Tacotron 2,它具有惊人的发音准确性,能够提供与真人声音几乎无法区分开来的发音。
据悉Tacotron 2已经是第二代技术,它由两个深度神经网络组成,一个将文本转换为特殊的图谱(如上图所示),第二个是WaveNet,会读取这个图谱并将其还原为一个真实的声音。
该系统目前只进行了英语女声的训练,它不仅可以阅读,而且还可以分辨细微差别,如果某个单词在句子中以大写字母突出显示,该系统在阅读这个句子时会为该单词添加一个相应的语调,该系统也能够处理少量的打字错误。
Tacotron 2还能根据语义来确定单词正确的音调,也能根据标点符号改变句子发音的韵律,甚至能够完美地讲绕口令。
更重要的是,Tacotron 2系统不仅仅是某种一直停留在实验室中的技术,谷歌实际上已经使用WaveNet网络在Google Assistant中生成更为真实的语音,一旦Tacotron 2更加完善后,它将被应用于Google Assistant等系统。
可点击此处试听Tacotron 2发音,点击此处试听其跟真人的发音区别,你能区分开来吗?
标签: 谷歌 最新 科技 AI 语音 真人 声音 难以 区分
声明:本文内容来源自网络,文字、图片等素材版权属于原作者,平台转载素材出于传递更多信息,文章内容仅供参考与学习,切勿作为商业目的使用。如果侵害了您的合法权益,请您及时与我们联系,我们会在第一时间进行处理!我们尊重版权,也致力于保护版权,站搜网感谢您的分享!