Cartesia Sonic 3.6 声音克隆实测:15秒样本生成多语种语音
先了解这件事
AI 综述
2026年10月3日,DAIR.AI 的 Elvis Saravia 在 X 上分享了 Cartesia Sonic 3.6 声音克隆功能的实测体验。他使用一段约15秒的音频样本在 Cartesia playground 中克隆了自己的声音,过程仅耗时几秒钟,并让克隆后的声音说出他本人不会说的日语。该功能基于 Cartesia 最新的语音模型 Sonic 3.6,支持44种语言。作者认为这项技术可用于让内容触达更多语言的受众。试用地址为 play.cartesia.ai,模型详情见 cartesia.ai/blog/sonic-3.6。
报道时间线
10月3日
- Cartesia Sonic 3.6 声音克隆实测:15秒样本即可生成多语种语音
作者在 Cartesia playground 用一段约15秒的音频克隆了自己的声音,几秒钟即完成,并让克隆声音说出他不会说的日语。该功能运行在 Cartesia 最新的语音模型 Sonic 3.6 上,支持44种语言,作者认为这项技术可用于让内容触达更多语言的受众,试用地址为 play.cartesia.ai,模型介绍见 cartesia.ai/blog/sonic-3.6。