Suno lança Speech: narração por IA com trilha sonora no mesmo áudio
Beta público no site e apps; voz e música juntas, com teto de cerca de 8 minutos
O Suno deixou de ser só o app que inventa músicas completas por inteligência artificial. Em 1º de outubro de 2026, o chief product officer Jack Brody anunciou o Speech em beta público: um modelo de áudio que gera voz falada e trilha sonora original no mesmo take, como uma peça única.
A função já está liberada no site e nos apps Android e iOS. A proposta é simples de descrever e bem ambiciosa na prática: você manda um texto ou uma ideia, escolhe o clima da voz e da música, e recebe uma narração com fundo que acompanha o ritmo, as pausas e o tom do que foi pedido.
O que o Speech gera de verdade
Segundo a Suno, o Speech é o primeiro modelo da casa feito para criar fala e soundtrack juntos, em um único arquivo coeso. Não é só grudar uma síntese de voz genérica (TTS) em cima de um loop: a ideia é que voz, interpretação, ritmo e música nasçam combinadas.
Dá para usar em poemas, meditações, pep talks, histórias de ninar, leituras dramáticas de mensagens bobas e qualquer outro experimento de “entretenimento criativo” que a empresa revisita no anúncio. Também dá para desligar a música com um interruptor (toggle) e ficar só com a voz limpa, se a trilha não fizer sentido para o projeto.

Imagem: Suno
Modos Simple e Advanced
No fluxo atual, o caminho passa pela aba Create e pela opção Speech. Há dois modos principais:
Simple - você descreve o resultado desejado no prompt (o texto de comando), no estilo “um capitão pirata motivando a tripulação”, e deixa o modelo montar fala e música a partir dessa ideia.
Advanced - entra o roteiro próprio, para quem já sabe exatamente o que quer ouvir. Nesse modo também dá para ajustar gênero da voz, estilo da fala e o quanto cada geração pode variar.
A duração máxima fica em torno de oito minutos, conforme a cobertura do The Verge e a demonstração publicada junto com o anúncio.

Imagem: Suno
Beta de verdade: sotaques e pausas
A Suno reforça que beta significa beta. Brody brinca que sotaques britânicos às vezes “passeiam” até a Austrália e voltam, e que pausas dramáticas podem ficar bem dramáticas. A empresa testou o recurso por cerca de um mês com um grupo menor e agora abre para todo mundo, prometendo iterar com base no que a comunidade gostar (e no que ainda emperrar).
Para quem pensa em publicar o áudio profissionalmente, o aviso prático é óbvio: revise antes de soltar. E, sobre uso comercial, o melhor caminho é checar os termos do plano Suno que você usa; detalhes de licença e créditos por geração não foram detalhados de forma fechada no anúncio do Speech.

Imagem: Suno
A Suno além da música cantada
Ferramentas de fala sintética já existem há anos, de experimentos da DeepMind a produtos como o ElevenLabs. O giro da Suno é casar essa voz com a própria máquina de música da plataforma, no mesmo fluxo em que a galera já faz música de aniversário, meme interno e trilha de casamento.
Na release notes oficiais, a Suno resume o Speech como o primeiro modelo a criar a fala e a trilha juntas, “em uma tomada”, citando exemplos que vão de história de ninar com piano suave a discurso de torcida com bateria de estádio. É a mesma casa de criação, agora com um canvas a mais: narrar, não só cantar.