物界前沿 · 资讯情报卡(IT之家 · 2026/10/3)

Suno推出Speech功能,可一体化生成语音与音乐

核心事实

物界观察

端到端生成语音加音乐,省去拼接环节,对播客、有声书等场景是效率提升。但口音漂移和过度戏剧化说明模型对语音细节控制仍弱。Suno从音乐切入语音,若打磨好,可能冲击传统TTS加配乐的工作流。

来源:IT之家原文 ↗