跳到正文
热点事件历史事件

Cartesia Sonic 3.6 声音克隆实测:15秒样本生成多语种语音

1 篇报道1 个报道来源3 天前更新

先了解这件事

AI 综述

2026年10月3日,DAIR.AI 的 Elvis Saravia 在 X 上分享了 Cartesia Sonic 3.6 声音克隆功能的实测体验。他使用一段约15秒的音频样本在 Cartesia playground 中克隆了自己的声音,过程仅耗时几秒钟,并让克隆后的声音说出他本人不会说的日语。该功能基于 Cartesia 最新的语音模型 Sonic 3.6,支持44种语言。作者认为这项技术可用于让内容触达更多语言的受众。试用地址为 play.cartesia.ai,模型详情见 cartesia.ai/blog/sonic-3.6。

AI 根据报道生成 · 1 天前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月3日
  1. X:Elvis Saravia (@omarsar0, DAIR.AI)
    Cartesia Sonic 3.6 声音克隆实测:15秒样本即可生成多语种语音

    作者在 Cartesia playground 用一段约15秒的音频克隆了自己的声音,几秒钟即完成,并让克隆声音说出他不会说的日语。该功能运行在 Cartesia 最新的语音模型 Sonic 3.6 上,支持44种语言,作者认为这项技术可用于让内容触达更多语言的受众,试用地址为 play.cartesia.ai,模型介绍见 cartesia.ai/blog/sonic-3.6。