Suno 推出「Speech」功能,可生成結合背景音樂的 AI 旁白配音
AI 音樂平台 Suno 推出公開測試版工具「Speech」,讓使用者能生成結合協調背景音樂的合成語音。

生成式音訊平台 Suno 正跳脫單純的歌曲創作領域,推出名為「Speech」的全新工具,可根據文字腳本或提示詞描述生成人聲語音。該功能目前已在 Suno 的網頁端與行動應用程式全面展開公開測試。
與傳統文字轉語音引擎不同,Suno 的主要優勢在於能在單一協調的音軌中,同時生成合成旁白配音與伴隨的背景音樂。
結合語音與配樂
Suno 表示,這款新工具旨在彌合口語表達與音樂伴奏之間的鴻溝。使用者只需在介面中選擇「Create」分頁,並切換至「Speech」選項即可開始使用。
Suno 產品長 Jack Brody 在公告中表示:「音樂永遠是 Suno 以及我們所打造產品的核心。同時,我們的願景也一直延伸至其他形式的人類表達。今天,我們透過 Speech 拓展了 Suno 的可能性:這是第一個將語音與音樂合而為一、生成單一協調音軌的音訊模型。」
雖然該系統旨在將語音與音樂伴奏搭配——例如在詩歌朗誦時配上寧靜舒緩的旋律,或在戲劇化演說中加入高張力的曲目——但背景音樂仍為選用項目。創作者若只需要純淨的人聲錄音,也可以透過內建開關將伴奏音軌關閉。
進軍競爭激烈的市場
透過深度學習進行語音合成已是一個發展成熟的領域。Google DeepMind 探索語音生成已有約十年之久,Adobe 亦提供專門的文字轉語音功能,而 ElevenLabs 等專用平台自 2023 年推出以來也獲得了廣泛採用。
透過推出 Speech,Suno 正將其產品版圖擴展至配音、說故事以及旁白敘事等領域。此一多元化發展正值該公司面臨持續的法律壓力之際——其核心的 AI 音樂生成引擎已引來唱片業的多起版權訴訟。



