AI RACE— The AI Race
New Models

Suno、音声読み上げとBGMを組み合わせた新機能「Speech」を発表

AI音楽スタートアップのSunoは、テキストの読み上げ音声とそれにマッチしたBGMを単一のオーディオとして同時に生成できる新機能「Speech」を公開した。

2026/10/03 03:07
Suno ra mắt tính năng 'Speech', kết hợp giọng đọc cùng nhạc nền

AI音楽ジェネレーターのSunoは、「Speech」と呼ばれる新機能のリリースにより、純粋な楽曲生成の枠を超えてサービスを拡大している。このツールは、話し言葉の音声とそれにマッチするBGMを同時に生成し、両方の要素を統合された1つのオーディオトラックとして出力する。

音声とサウンドトラックの同時生成

この機能を利用するには、ユーザーがテキストやアイデアを入力し、希望する声質や音楽スタイルを指定する。すると、モデルがナレーションとそれを引き立てるBGMの両方を生成する。

SunoのプロダクトチーフであるJack Brody氏によると、同社は一般公開に先立ち、少人数のテストグループとともにSpeechの検証を1カ月間にわたって実施したという。Sunoは、この機能を詩の朗読やガイド付き瞑想、寝かしつけ用の読み聞かせなどのコンテンツ制作に活用できると提案している。

なお、同機能は現在ベータ版であるため、イギリス英語のアクセントが途中でオーストラリア英語のように聞こえるといった音声の不整合など、時折バグが発生することがあるとSunoは付記している。

学習データへの疑問と続く法的圧力

Sunoは、Speech機能を支える基盤モデルの学習方法に関する詳細を明らかにしていない。

今回のアップデートは、生成AI音楽プラットフォームが学習データの出所を巡って厳しい監視の目にさらされる中で行われた。大手レコードレーベル各社は著作権侵害の疑いでSunoを提訴している。さらに、ミュンヘンの裁判所は最近、著作権で保護されたコンテンツの利用に対する法的な正当化事由としてのフェアユース(公正利用)の主張を退け、同スタートアップに不利な判決を下した。

関連記事