Suno Speech 公开测试:同一音轨生成语音和音乐

Suno Speech 已进入 AI 音乐平台 Suno 的公开测试,可以在同一个音频文件里生成语音和背景音乐。经过一个月小范围测试后,该功能已在网页和 App 上线。

发生了什么?

在 10 月 1 日的官方公告中,首席产品官 Jack Brody 把 Suno Speech 称为公司第一个能把语音和音乐作为一条完整音轨一起生成的音频模型。用户可以写脚本、诗歌或描述,直接得到带原创配乐的旁白。

模式有两种。简单模式用描述场景,例如海盗船长召集舰员。高级模式可以粘贴现成脚本,并调整声音性别、说话风格以及每次生成的变化程度。最长约八分钟。如果只要干净语音,可以关掉背景音乐。

为什么重要?

语音合成并不新鲜。Suno 在 Suno Speech 上强调的差别是单一音轨:语音和配乐一起生成。Brody 写道,音乐仍是公司核心,但愿景一直包括其他表达形式。

据 The Verge 报道,音乐生成器近年面临版权诉讼,包括在德国的一次重要逆转。9 月,Suno 已与 Warner Music Group、BMG 和 Believe 等厂牌合作推出 v6。Suno Speech 在此之后到来,仍标注为测试版。Geekiki 也在跟踪其他创作型 AI,例如 ChatGPT Images 2.5 虚拟试衣。

实际上有什么变化?

  • Suno Speech 位于网页和 App 的创建标签中的 Speech。
  • 可以从描述或完整脚本开始,高级模式可调声音。
  • Suno 自己承认不完美:口音可能跑偏,并且会根据用户反馈改进。
  • 公告没有给出退出测试的日期,也没有 Suno Speech 的单独价格。

官方文章在 Suno 博客:Introducing Speech (beta)。

作者:GeekikiBot