AI RACE— The AI Race
New Models

Suno、BGM付きのAI音声を生成できる新機能「Speech」を発表

AI音楽プラットフォームのSunoは、調和のとれたBGMを伴う合成音声を生成できるツール「Speech」のパブリックベータ版を公開した。

2026/10/02 16:42
Suno ra mắt tính năng ‘Speech’, cho phép tạo giọng đọc AI lồng ghép nhạc nền

生成オーディオプラットフォームのSunoは、楽曲生成の枠を超え、テキストスクリプトやプロンプトによる指示に基づいて音声を生成する新ツール「Speech」を発表した。同機能は現在、SunoのWebアプリおよびモバイルアプリにてパブリックベータ版として利用可能だ。

従来のテキスト読み上げ(TTS)エンジンとは異なり、Sunoの最大の差別化要素は、合成音声とそれに合わせたBGMを、ひとつのまとまりのある単一オーディオトラックとして同時に生成できる点にある。

音声と伴奏の融合

Sunoによると、新ツールは話し言葉の語りと音楽の伴奏の間にある隔たりを埋めることを目的としている。ユーザーはインターフェース内の「Create」タブを選択し、「Speech」オプションに移動することで同機能を利用できる。

Sunoの最高製品責任者(CPO)であるJack Brody氏は発表の中で、「音楽は常にSunoの中心であり、私たちが構築するものの核であり続けます。同時に、私たちのビジョンは常に他の形態の人間の表現にも広がっていました」と述べた。「本日、私たちは音声と音楽をひとつのまとまりのあるトラックとして同時に生成する初のオーディオモデル『Speech』によって、Sunoで実現できる可能性をさらに広げます」

同システムは、詩の朗読に落ち着いたメロディを合わせたり、ドラマチックなスピーチに高揚感のあるトラックを添えたりと、音声と伴奏音楽を組み合わせるよう設計されているが、BGMの追加は任意だ。音声のみのクリアな録音を必要とするクリエイターは、内蔵のトグル機能を使って伴奏サウンドトラックをオフにすることもできる。

激戦区への参入

ディープラーニングによる音声合成は、すでに確立された分野だ。Google DeepMindは約10年にわたり音声生成を研究してきたほか、Adobeも専用のテキスト読み上げ機能を提供しており、ElevenLabsなどの特化型プラットフォームは2023年のローンチ以降、広く普及している。

「Speech」の投入により、Sunoは製品ポートフォリオを声優、ストーリーテリング、ナレーションの領域へと拡大している。主力であるAI音楽生成エンジンをめぐりレコード業界から複数の著作権侵害訴訟を起こされるなど、同社が法的な圧力に対処し続ける中で、今回の事業多角化が進められる形となった。

◗ 出典

The Verge10/02

関連記事