观点网讯:2月18日,据外媒报道,亚马逊的一个人工智能研究团队开发出有史以来最大的文本转语音模型。
这个名为BASETTS的新模型拥有9.8亿个参数,在同类产品中最大,在规模和能力上都超越了之前的迭代版本。
据报道,它使用了10万个小时的录音来进行训练,其中大部分为英语语音,但也包括德语、荷兰语和西班牙语,这使它成为自然语音的新标准。
这一突破标志着文本转语音技术的发展向前迈出了重要的一步,在不久的将来有可能得到广泛的应用。
研究人员表示,尽管遇到了文本转语音引擎固有的困难,如发音错误或语调错误,但该模型在处理复杂的语言结构方面表现出了非凡的能力。与之前的文本转语音模型相比,该模型提高了单词的发音质量。然而,为了避免滥用,BASETTS不会向公众发布,而是计划作为一种学习应用。
来源:观点网
上一篇:丁磊,过了一个肥年