跳到正文
原文
omarsar0· @omarsar0 · X·· 4 天前AI 评分52

Cartesia Sonic 3.6 声音克隆实测:15秒样本即可生成多语种语音

AI 导读

作者在 Cartesia playground 用一段约15秒的音频克隆了自己的声音,几秒钟即完成,并让克隆声音说出他不会说的日语。该功能运行在 Cartesia 最新的语音模型 Sonic 3.6 上,支持44种语言,作者认为这项技术可用于让内容触达更多语言的受众,试用地址为 play.cartesia.ai,模型介绍见 cartesia.ai/blog/sonic-3.6。

正文 · AI 翻译

这太厉害了!

我在 @cartesia 的演示平台上,用一段约 15 秒的音频克隆了自己的声音。几秒钟内克隆就完成了。

然后我让它说日语——我本人并不会说日语。

我的克隆声音现在用日语说,我可以结合 AI 和自己审稿的经验来找到好论文。

这效果听起来太棒了,我非常 impressed。

它运行在 Sonic 3.6 上,这是他们最新的语音模型,支持 44 种语言。你可以用其中任何一种语言做同样的事。

这项技术真的越来越好了,我认为值得探索,用不同语言让你的内容触达更多人。

在这里试试:play.cartesia.ai
关于该模型的更多信息:cartesia.ai/blog/sonic-3.6

来源:omarsar0 · x.com