Suno, 음성 오디오와 배경음악 결합한 'Speech' 기능 공개
AI 음악 스타트업 Suno가 음성 텍스트와 어울리는 배경음악을 단일 오디오 트랙으로 함께 생성할 수 있는 신기능 'Speech'를 출시했다.

AI 음악 생성 플랫폼 Suno가 신기능 'Speech'를 선보이며 단순 음악 생성을 넘어 영역을 확장하고 있다. 이 도구는 말로 된 음성(스포큰 워드) 오디오와 이에 어울리는 배경음악을 함께 제작해 두 요소를 하나의 통합된 오디오 트랙으로 출력한다.
음성과 사운드트랙의 동시 생성
이 기능을 이용하려면 사용자가 텍스트나 아이디어를 입력하고 선호하는 음성과 음악 스타일을 설명하면 된다. 그러면 모델이 내레이션 음성과 이를 보완하는 배경음을 동시에 생성한다.
Suno의 Jack Brody 제품 총괄에 따르면, 회사는 전면 출시에 앞서 소규모 테스트 그룹과 함께 한 달 동안 Speech 기능을 평가했다. Suno는 사용자가 시, 명상 가이드, 수면 동화와 같은 콘텐츠를 제작하는 데 이 기능을 활용할 수 있다고 설명했다.
다만 해당 기능은 아직 베타 단계에 머물러 있어, 영국식 억양이 간헐적으로 호주식 억양처럼 들리는 음성 불일치 문제를 비롯해 가끔 버그가 발생할 수 있다고 Suno 측은 덧붙였다.
학습 데이터 논란과 지속되는 법적 압박
Suno는 Speech 기능의 기반이 되는 모델을 어떻게 훈련했는지에 대한 구체적인 내용은 공개하지 않았다.
이번 기능 업데이트는 생성형 음악 플랫폼들이 학습 데이터 출처를 두고 거센 감시와 조사를 받는 시점에 이뤄졌다. 주요 음반사들은 잠재적인 저작권 침해를 이유로 Suno를 상대로 소송을 제기한 상태다. 아울러 최근 뮌헨 법원은 저작권이 있는 저작물을 활용하는 법적 정당성으로 제시된 '공정 이용(fair use)' 주장을 기각하며 이 스타트업에 불리한 판결을 내린 바 있다.



