AI RACE— A Corrida da IA
New Models

Suno lança o recurso 'Speech' para gerar locuções em IA com música de fundo

A plataforma de música com IA Suno lançou uma ferramenta em beta público chamada Speech, permitindo que os usuários criem vozes sintéticas acompanhadas por uma trilha musical coesa.

02/10/2026, 16:42
Suno ra mắt tính năng ‘Speech’, cho phép tạo giọng đọc AI lồng ghép nhạc nền

A plataforma de áudio generativo Suno está expandindo seus horizontes além da criação musical com o lançamento do "Speech", uma nova ferramenta projetada para gerar vozes faladas a partir de roteiros escritos ou descrições em prompts. O recurso já está disponível em versão beta pública nos aplicativos web e móveis da Suno.

Diferente dos mecanismos convencionais de conversão de texto em fala (text-to-speech), o principal diferencial da Suno é a capacidade de produzir simultaneamente locuções sintéticas e trilhas musicais de fundo em uma única faixa de áudio coesa.

Combinando voz e trilha sonora

De acordo com a Suno, a nova ferramenta busca aproximar a locução falada do acompanhamento musical. Os usuários podem acessar a novidade selecionando a aba "Create" na interface e navegando até a opção "Speech".

“A música sempre estará no coração da Suno e de tudo o que construímos. Ao mesmo tempo, nossa visão sempre se estendeu a outras formas de expressão humana”, afirmou Jack Brody, diretor de produto da Suno, no comunicado. “Hoje, estamos expandindo o que é possível na Suno com o Speech: o primeiro modelo de áudio que gera voz e música juntas como uma faixa coesa.”

Embora o sistema tenha sido projetado para combinar a fala com um fundo musical — como melodias tranquilas sob poesias ou faixas de alta energia sob discursos dramáticos —, a música de fundo permanece opcional. Os criadores que precisarem apenas de gravações de voz limpas podem desativar a trilha sonora por meio de um botão integrado.

Entrando em um mercado concorrido

A síntese de voz via deep learning é um setor já consolidado. A Google DeepMind pesquisa a geração de fala há cerca de uma década, a Adobe disponibiliza recursos dedicados de text-to-speech e plataformas especializadas como a ElevenLabs conquistaram ampla adesão desde seu lançamento em 2023.

Com a chegada do Speech, a Suno amplia seu portfólio de produtos para áreas como atuação de voz, contação de histórias e narração. Essa diversificação acontece em um momento em que a empresa continua enfrentando pressões jurídicas, visto que seu motor principal de geração de música por IA atraiu diversos processos de direitos autorais movidos pela indústria fonográfica.

◗ Fontes

The Verge02/10

Notícias relacionadas