Suno 推出 Speech,语音与音乐合成单轨
2026/10/03 — 10/03 14:11·1 个来源·1 篇报道
事件概览
当地时间 10 月 1 日,AI 音乐制作平台 Suno 宣布推出 Speech,Suno 称这是业界首个能够把语音与音乐作为单一连贯音轨共同生成的音频模型。据 IT 之家 10 月 3 日报道,该模型不像传统工作流那样先做 TTS(文本转语音)再拼接 BGM,而是端到端一体化生成,是首个能单次生成完整融合「语音朗读 + 原创 BGM」的端到端闭源音频模型。在过去一个月里,Suno 与小范围用户共同测试了这一功能,随后正式面向所有人开放 Beta 公测。
该功能已直接内置于 Suno 中,用户只需输入一个灵感、一首诗或一段文字,再描述自己想要的音色与音乐风格,就可以创作带有 BGM 的语音音频。Suno 官方同时列出了 Beta 版的不足:当前版本偶发口音不稳定,例如英音可能在中途漂移到澳音,然后又漂回来;语调与情感停顿有时会显得过于戏剧化。上述说法均来自 Suno 官方,报道没有给出更多技术细节,也没有提及测试范围之外的时间安排。
AI 综合 1 篇报道生成 · 更新于 21 分钟前
最新进展Suno 推出 Speech,宣称是业界首个能把语音与音乐作为单一连贯音轨、端到端生成的音频模型,不再先做 TTS 再拼 BGM。该功能已内置于 Suno 并向所有人开放 Beta 公测,官方提示当前版本偶发口音漂移、语调与停顿过于戏剧化等问题。

这件事的报道 点标题看原文
Suno 推出 Speech,宣称是业界首个能把语音与音乐作为单一连贯音轨、端到端生成的音频模型,不再先做 TTS 再拼 BGM。该功能已内置于 Suno 并向所有人开放 Beta 公测,官方提示当前版本偶发口音漂移、语调与停顿过于戏剧化等问题。
Suno 新功能,做带 BGM 语音的可以试试
同时在说的其他事
- 523英伟达发布 64GB 版 DGX Spark,售价 4999 美元8 个来源
- 509Apple 收紧 macOS 全盘访问权限,防范 AI Agent 风险7 个来源
- 378Meta 开源 Muse Gadgets 固件与 SDK5 个来源
- 253爆微软发布 MAI-Transcribe-2-Streaming 实时转写模型4 个来源
- 221爆亚马逊拟将约 80 亿美元英伟达芯片转入融资载体3 个来源
- 215Anthropic 投 1 亿美元启动 Claude 工程师学院3 个来源
热度怎么算的?了解口径收起
热度按 48 小时内有多少个独立来源在说这件事算:同一个来源发多条只算一次,并按 24 小时半衰期衰减,所以排前面的是很多人在说的事。
本页汇总公开订阅源,标题与摘要由模型整理,版权归原作者所有;重要信息请回原文核对。
- 爆
- 讨论快速增加
- 新
- 首报 6 小时内
- 发酵中
- 讨论仍在增加
