资讯1 分钟阅读·
Suno开放语音音乐一体生成公测,官方承认口音会漂移
语音与配乐可单次生成,省去拼接流程,但口音漂移等缺陷说明Beta阶段仍需人工把关。
重要性局部证据E3 可检验写法快讯
Suno于10月1日宣布推出Speech功能,向所有用户开放公测,宣称这是首个将语音与音乐作为单一连贯音轨共同生成的音频模型。
传统做法是先做文本转语音、再单独拼接背景音乐;Speech改为端到端一体化生成,输入一段文字并描述想要的音色与音乐风格,即可得到带原创配乐的语音音频。该功能内置于AI音乐平台Suno中。
官方同时列出了当前版本的不足:口音可能中途漂移,例如英音漂成澳音再漂回;语调与停顿有时过于戏剧化,导致断句节奏偏慢。