AI RACE— AI Race
New Models

Suno, 배경음악 결합된 AI 보이스오버 생성 기능 'Speech' 출시

AI 음악 플랫폼 Suno가 조화로운 배경음악과 함께 합성 음성을 생성할 수 있는 퍼블릭 베타 도구 'Speech'를 선보였다.

2026. 10. 02. 16:42
Suno ra mắt tính năng ‘Speech’, cho phép tạo giọng đọc AI lồng ghép nhạc nền

생성형 오디오 플랫폼 Suno가 텍스트 스크립트나 프롬프트 설명을 바탕으로 음성을 생성하는 신규 도구 'Speech'를 출시하며 음악 제작을 넘어 영역 확장에 나섰다. 해당 기능은 현재 Suno의 웹 및 모바일 애플리케이션에서 퍼블릭 베타로 제공된다.

기존의 텍스트 음성 변환(TTS) 엔진과 달리, Suno의 가장 큰 차별점은 단일 통합 오디오 트랙 안에서 합성 보이스오버와 그에 어울리는 배경음악을 동시에 생성할 수 있다는 점이다.

음성과 배경음악의 결합

Suno에 따르면 이번 신규 도구는 음성 전달과 음악 반주 사이의 간극을 좁히는 것을 목표로 한다. 이용자는 인터페이스 내 'Create' 탭을 선택한 뒤 'Speech' 옵션으로 이동해 이 기능을 이용할 수 있다.

Jack Brody Suno 최고제품책임자(CPO)는 발표를 통해 "음악은 언제나 Suno와 우리가 구축하는 모든 것의 중심에 있을 것이지만, 동시에 우리의 비전은 항상 인간의 다른 표현 방식으로도 뻗어 있었다"라며 "오늘 우리는 음성과 음악을 하나의 조화로운 트랙으로 함께 생성하는 최초의 오디오 모델인 Speech를 통해 Suno에서 가능한 영역을 넓히고 있다"고 밝혔다.

이 시스템은 시 낭송에 곁들이는 차분한 멜로디나 극적인 연설 아래 깔리는 에너지 넘치는 트랙처럼 음성과 배경음악을 함께 구성하도록 설계됐으나, 배경음악 추가는 선택 사항이다. 배경음 없는 깔끔한 음성 녹음본만 필요한 창작자는 내장된 토글 버튼을 사용해 배경 트랙을 끌 수 있다.

경쟁 치열한 시장 진입

딥러닝을 활용한 음성 합성은 이미 성숙한 분야다. Google DeepMind는 약 10년 동안 음성 생성을 연구해 왔으며, Adobe는 전용 TTS 기능을 제공하고 있고, ElevenLabs와 같은 전문 플랫폼은 2023년 출시 이후 폭넓게 활용되고 있다.

Suno는 이번 Speech 도입을 통해 제품 포트폴리오를 성우 연기, 스토리텔링, 내레이션 영역으로 확장하고 있다. 이러한 사업 다각화는 핵심 AI 음악 생성 엔진을 둘러싸고 음반 업계로부터 여러 건의 저작권 침해 소송을 당하는 등 회사가 지속적인 법적 압박을 겪고 있는 상황에서 추진됐다.

관련 기사