Suno lança recurso 'Speech', combinando áudio falado e música de fundo
A startup de música por IA Suno lançou um novo recurso chamado Speech, permitindo que os usuários gerem texto falado acompanhado de faixas de fundo em um único arquivo de áudio.

O gerador de música por IA Suno está expandindo para além da criação exclusiva de canções com o lançamento de um novo recurso chamado "Speech". A ferramenta produz áudio de texto falado e música de fundo correspondente juntos, entregando ambos os elementos como uma única faixa de áudio integrada.
Gerando voz e trilhas sonoras simultaneamente
Para usar o recurso, os usuários digitam um texto ou uma ideia e descrevem a voz e o estilo musical de sua preferência. O modelo, então, gera tanto a locução quanto o som de fundo complementar.
Segundo o chefe de produto da Suno, Jack Brody, a empresa avaliou o Speech com um pequeno grupo de testes durante um mês antes do lançamento geral. A Suno sugere que os usuários podem aproveitar o recurso para produzir conteúdos como poemas, meditações guiadas e histórias para dormir.
Como o recurso ainda está em fase beta, a Suno destacou que ele ainda apresenta bugs ocasionais, incluindo inconsistências de voz em que um sotaque britânico pode soar australiano de forma intermitente.
Dúvidas sobre treinamento e pressões jurídicas contínuas
A Suno não divulgou detalhes sobre como treinou o modelo subjacente que alimenta o recurso Speech.
A novidade chega em um momento em que plataformas de música generativa enfrentam um escrutínio crescente sobre as fontes de seus dados de treinamento. Grandes gravadoras entraram com processos judiciais contra a Suno por possíveis violações de direitos autorais. Além disso, um tribunal de Munique recentemente decidiu contra a startup, rejeitando argumentos de fair use como justificativa legal para a utilização de material protegido por direitos autorais.



