今年早些时候,百度推出了一个名叫 DeepVoice 的全新人工智能系统,借助热门的深度学习技术,它能够实现文本到语音(TTS)的转换。初版 DeepVoice 可以产生较短的语句,不仔细听还以为是个真人在说话。该系统还可以每次学习一种声音,在数小时后即可掌握。而今年 5 月份推出 DeepVoice 2,可以在一小时内模仿出一种口音,单系统就可以学习数百种不同的口音。现在,百度推出了 DeepVoice 的“最终版”,声称可以在每半个小时内完成对 10000 种语音的数据学习。这种高效生成各种各样声音的技术,为许多用例打开了大门。(cnBeta)原文链接