AB
AiBoss
News

Suno 推出 Speech 功能:AI 音乐平台开始生成口播语音

AI 音乐生成平台 Suno 上线 Speech 功能,可同时生成口播语音与背景音乐,目前以公开测试形式在网页端和移动端提供,单条最长约八分钟。

Suno 上线 Speech 功能,语音与音乐可一并生成

据 The Verge 报道,AI 音乐生成平台 Suno 推出名为 Speech 的新功能,可根据脚本或提示词描述生成口播语音。该功能目前以公开测试(public beta)形式在 Suno 的网页端和移动端提供,支持在同一条音轨中同时生成语音与背景音乐。Suno 首席产品官 Jack Brody 在公告中表示,音乐始终是 Suno 的核心,但公司的愿景也延伸到其他人类表达形式,Speech 是「首个将人声与音乐作为一条完整音轨一起生成的音频模型」。

功能定位与使用方式

据该报道,Speech 提供两种模式:Simple 模式通过提示框描述想要的内容,Advanced 模式则允许用户直接输入自定义脚本。高级设置中可调整 AI 声音的性别、语音风格,以及每次生成之间的变化程度。背景音乐为可选项,用户可通过开关关闭,只保留纯语音。报道提到,Speech 单条生成的最长时长约为八分钟。Suno 方面也承认该功能尚不完善,Brody 称「beta 就是 beta」,并提到英式口音偶尔会飘到澳式口音、戏剧性停顿可能过于夸张等情况,表示会依据用户反馈持续改进。AI 语音合成并非新事物,报道提及 DeepMind 长期进行深度学习语音合成研究、Adobe 提供文本转语音工具、ElevenLabs 自 2023 年推出以来已成为较受关注的平台之一。报道还指出,Suno 此举可能与其音乐生成器面临多起诉讼、需要多元化平台业务有关。

限制与来源

上述功能细节、可用平台与时长上限均来自 The Verge 的报道及 Suno 方面的公告表述,具体功能范围、支持语言、账号类型与地区可用性可能随时调整,请以 Suno 官网当前信息为准。该功能仍处于公开测试阶段,实际效果与稳定性尚未获官方完整确认。