- Published on
Suno Speech 测试版:语音与音乐一次生成——AI同时创作旁白和背景音乐
写下文字,音乐随之而来。Suno Speech测试版不是"文字→语音",而是"文字→语音+音乐"。
2026年10月1日,Suno经过一个月的小规模测试后,正式向全平台网页和移动端用户开放Speech测试版。这次发布清晰表明:AI音乐平台Suno正在从"生成歌曲"扩展到"音频内容创作全域"。
Speech与传统TTS的区别
普通的文字转语音(TTS)工具只是把文字转换成声音朗读。仅此而已。要加背景音乐,还需要单独准备音乐文件,再在编辑软件里将两个层次合并。
Suno Speech颠覆了这个流程。语音和背景音乐在同一个模型中同时生成。 因为两者从一开始就"了解"彼此,节奏和情感流动自然吻合,无需后期编辑。
使用方法
操作简单直接。
- 输入文本:粘贴要朗读的内容。诗歌、睡前故事、演讲稿、ASMR脚本、冥想引导——任何形式均可。
- 描述声音:用自然语言指定音调、性别和氛围。"温暖平静的女声"或"充满活力的男性主持人声音"都可以。
- 设定音乐风格:描述背景音乐的流派和氛围。"轻柔钢琴""体育场鼓声""Lo-Fi嘻哈"均适用。
- 生成:输出是一个完整的、融合在一起的音频文件。
应用场景
Suno在内部测试中展示的示例:
- 睡前故事:在轻柔钢琴伴奏下,为孩子朗读故事。
- 励志演讲:充满活力的声音配上体育场鼓声。
- ASMR内容:日常文本("把购物的东西一件件整理好")转化为ASMR特有的柔和声音和氛围音景。
- 冥想引导:冥想脚本与自然音效背景合为一个音频。
- 诗歌朗诵:诗歌配上戏剧性声音和情感匹配的音乐,成为一件音频作品。
教育与教育科技视角
对教师和教育内容创作者来说,这里有切实的可能性。
学习资料音频化:教师写的说明文本通过Speech转化后,就成了带背景音乐的可收听学习资料,同时照顾到阅读型和听觉型学习者。
学生创作活动:把学生写的短篇或诗歌通过Speech转化并分享,能为创作活动带来即时反馈和成就感。
微型讲座播客:把讲义转化为对话形式,制作成通勤途中也能收听的微型内容。
注意事项
Speech目前处于测试版阶段。所有Suno用户均可使用,但生成质量因提示词的具体程度而异。与v6和v6-wild一样,对声音和音乐风格的描述越具体,效果越接近预期。
商业用途适用与Suno音乐功能相同的许可条款,发布前请确认所在套餐的条款。
总结
音频内容创作过去需要两步:录制声音,然后添加背景音乐。Suno Speech将这两步合并为一步。新的起点是一行文字。
对播客主、教育内容创作者、营销人员和故事讲述者来说,这值得现在就去尝试。
Source:
- Suno Moves Beyond AI Music With New Speech Tool — TechCrier, October 2026
- Suno Release Notes — Suno Official
- Suno Launches Speech Beta, Pairing Voice and Music in One Model — Unite.AI