Suno 推出 Speech 功能公测:可生成配音与背景音乐
Suno 上线 Speech 功能公测,用户可在网页和移动端生成配音,并与 AI 背景音乐合成为同一音轨。
Suno 推出了名为 Speech 的新功能,可根据脚本或提示描述生成人声。该功能目前以公测形式在 Suno 的网页端和移动端上线。
据 Suno 介绍,Speech 可以把配音和背景音乐生成在同一条音轨中。功能提供 Simple 和 Advanced 两种模式,其中 Advanced 模式允许用户自定义脚本,并调整声音性别、语音风格和变化程度。
Speech 的最长时长约为 8 分钟。Suno 表示,将根据用户反馈持续改进该功能。
语音合成赛道竞争加剧
语音合成并非新领域。DeepMind 在深度学习语音合成方面已探索了 10 年,Adobe 也拥有文本转语音工具。2023 年上线的 ElevenLabs 已成为最受关注的文本转语音平台之一。
与此同时,Suno 的音乐生成器已招致多起诉讼。此次 Speech 功能的上线,意味着 Suno 在音乐生成之外进一步扩展其音频生成能力。
快速问答
Suno 的 Speech 功能现在可以使用吗?
可以。Speech 目前以公测形式在 Suno 的网页端和移动端提供。
Speech 最长可以生成多长的音频?
最长时长约为 8 分钟。
Speech 能同时生成配音和背景音乐吗?
可以,该功能可将配音和背景音乐生成为同一条音轨。