Suno 推出 Speech,語音與音樂合成單軌
2026/10/03 — 10/03 14:11·1 個來源·1 篇報道
事件概覽
當地時間 10 月 1 日,AI 音樂製作平臺 Suno 宣佈推出 Speech,Suno 稱這是業界首個能夠把語音與音樂作為單一連貫音軌共同生成的音訊模型。據 IT 之家 10 月 3 日報道,該模型不像傳統工作流那樣先做 TTS(文本轉語音)再拼接 BGM,而是端到端一體化生成,是首個能單次生成完整融合「語音朗讀 + 原創 BGM」的端到端閉源音訊模型。在過去一個月裡,Suno 與小範圍使用者共同測試了這一功能,隨後正式面向所有人開放 Beta 公測。
該功能已直接內置於 Suno 中,使用者只需輸入一個靈感、一首詩或一段文字,再描述自己想要的音色與音樂風格,就可以創作帶有 BGM 的語音音訊。Suno 官方同時列出了 Beta 版的不足:當前版本偶發口音不穩定,例如英音可能在中途漂移到澳音,然後又漂回來;語調與情感停頓有時會顯得過於戲劇化。上述說法均來自 Suno 官方,報道沒有給出更多技術細節,也沒有提及測試範圍之外的時間安排。
AI 綜合 1 篇報道生成 · 更新於 20 分鐘前
最新進展Suno 推出 Speech,宣稱是業界首個能把語音與音樂作為單一連貫音軌、端到端生成的音訊模型,不再先做 TTS 再拼 BGM。該功能已內置於 Suno 並向所有人開放 Beta 公測,官方提示當前版本偶發口音漂移、語調與停頓過於戲劇化等問題。

這件事的報道 點標題看原文
Suno 推出 Speech,宣稱是業界首個能把語音與音樂作為單一連貫音軌、端到端生成的音訊模型,不再先做 TTS 再拼 BGM。該功能已內置於 Suno 並向所有人開放 Beta 公測,官方提示當前版本偶發口音漂移、語調與停頓過於戲劇化等問題。
Suno 新功能,做带 BGM 语音的可以试试
同時在說的其他事
- 523輝達釋出 64GB 版 DGX Spark,售價 4999 美元8 個來源
- 509Apple 收緊 macOS 全盤訪問許可權,防範 AI Agent 風險7 個來源
- 378Meta 開源 Muse Gadgets 韌體與 SDK5 個來源
- 253爆微軟釋出 MAI-Transcribe-2-Streaming 即時轉寫模型4 個來源
- 221爆亞馬遜擬將約 80 億美元輝達晶片轉入融資載體3 個來源
- 215Anthropic 投 1 億美元啟動 Claude 工程師學院3 個來源
熱度怎麼算的?瞭解口徑收起
熱度按 48 小時內有多少個獨立來源在說這件事算:同一個來源發多條只算一次,並按 24 小時半衰期衰減,所以排前面的是很多人在說的事。
本頁彙總公開訂閱源,標題與摘要由模型整理,版權歸原作者所有;重要資訊請回原文核對。
- 爆
- 討論快速增加
- 新
- 首報 6 小時內
- 發酵中
- 討論仍在增加
