HaiAI123

全球AI工具精选导航

新热点事件
97
热度指数
新上榜

Suno 推出 Speech,语音与音乐合成单轨

2026/10/03 — 10/03 14:11·1 个来源·1 篇报道

事件概览

当地时间 10 月 1 日,AI 音乐制作平台 Suno 宣布推出 Speech,Suno 称这是业界首个能够把语音与音乐作为单一连贯音轨共同生成的音频模型。据 IT 之家 10 月 3 日报道,该模型不像传统工作流那样先做 TTS(文本转语音)再拼接 BGM,而是端到端一体化生成,是首个能单次生成完整融合「语音朗读 + 原创 BGM」的端到端闭源音频模型。在过去一个月里,Suno 与小范围用户共同测试了这一功能,随后正式面向所有人开放 Beta 公测。

该功能已直接内置于 Suno 中,用户只需输入一个灵感、一首诗或一段文字,再描述自己想要的音色与音乐风格,就可以创作带有 BGM 的语音音频。Suno 官方同时列出了 Beta 版的不足:当前版本偶发口音不稳定,例如英音可能在中途漂移到澳音,然后又漂回来;语调与情感停顿有时会显得过于戏剧化。上述说法均来自 Suno 官方,报道没有给出更多技术细节,也没有提及测试范围之外的时间安排。

AI 综合 1 篇报道生成 · 更新于 21 分钟前

最新进展Suno 推出 Speech,宣称是业界首个能把语音与音乐作为单一连贯音轨、端到端生成的音频模型,不再先做 TTS 再拼 BGM。该功能已内置于 Suno 并向所有人开放 Beta 公测,官方提示当前版本偶发口音漂移、语调与停顿过于戏剧化等问题。

相关工具

这件事的报道 点标题看原文

今天
  1. Suno 推出 Speech,宣称是业界首个能把语音与音乐作为单一连贯音轨、端到端生成的音频模型,不再先做 TTS 再拼 BGM。该功能已内置于 Suno 并向所有人开放 Beta 公测,官方提示当前版本偶发口音漂移、语调与停顿过于戏剧化等问题。

    Suno 新功能,做带 BGM 语音的可以试试

    IT之家AI 评分 85

同时在说的其他事

热度怎么算的?了解口径

热度按 48 小时内有多少个独立来源在说这件事算:同一个来源发多条只算一次,并按 24 小时半衰期衰减,所以排前面的是很多人在说的事。

本页汇总公开订阅源,标题与摘要由模型整理,版权归原作者所有;重要信息请回原文核对。

爆
讨论快速增加
新
首报 6 小时内
发酵中
讨论仍在增加

回热点事件榜 →