Suno语音功能
3 etapas2 peças4 Fontes
AI音乐平台Suno于2026年10月1日正式推出“Speech”测试版,宣称这是业界首个能将人声旁白与原创背景音乐作为单一连贯音轨同步生成的模型。该功能旨在简化音频创作流程,用户只需输入文本或描述,即可一次性获得配音加配乐的作品,无需后期拼接。尽管Suno强调其核心仍是音乐,但此举标志着其从歌曲生成向更广泛的“创意娱乐”领域扩张。
然而,这一创新发生在Suno深陷版权争议的敏感时期。虽然华纳音乐已与其和解并合作开发v6模型,但环球音乐和索尼音乐仍在起诉Suno,指控其非法使用超过6万首录音训练模型,索赔高达90亿美元。此外,测试版存在口音漂移、停顿夸张等稳定性问题,且商业使用条款尚不明确,引发创作者对合规性的担忧。
Como chegamos aqui
Suno发布v6音乐模型,由Warner Music Group、BMG和Believe授权数据训练,计划逐步淘汰旧模型。
techcrunch.com ↗Suno正式向所有Web、iOS和Android用户开放Speech测试版,支持简易模式(生成脚本+音频)和高级模式(自定义脚本+音色控制)。
suno.com ↗媒体报道指出Speech单次生成最长约8分钟,但存在英音漂移到澳音、停顿过于戏剧化等Beta阶段缺陷。
theverge.com ↗
O que ainda está indefinido
- Speech功能的具体语言支持范围及非英语市场的可用性如何?
- 在环球和索尼的诉讼背景下,Speech生成内容的商业使用权归属是否会有法律风险?
- Suno是否会为Speech推出独立的定价方案,还是继续沿用现有的积分制?