O Suno Speech beta transforma um roteiro em uma faixa narrada com trilha sonora original, mas não funciona como um mecanismo de texto para fala de precisão. Ele é indicado para peças curtas e expressivas em que a música faz parte do resultado. Quando cada palavra, pausa e pronúncia precisa ser reproduzida de forma consistente, prefira uma ferramenta dedicada de TTS.
Saiba se o Suno Speech é adequado para o seu projeto
O Suno Speech funciona melhor para narrações curtas acompanhadas de música do que para produzir voice-overs exatos. O beta de outubro de 2026 se destaca quando uma performance um pouco imprevisível é aceitável — e perde força quando o projeto exige texto, duração ou identidade vocal rigorosamente consistentes.
| Projeto | Usar o Suno Speech? | Motivo |
|---|---|---|
| História para dormir com piano suave | Sim | A fala e a trilha sonora original são criadas em uma única geração. |
| Meditação ou poema dramático | Sim, depois de revisar | O ritmo expressivo combina com o formato, mas pausas e sotaques podem variar. |
| Monólogo curto de personagem | Vale testar | A interpretação pode funcionar bem, embora a pronúncia exata não seja garantida. |
| Tutorial de produto com timecodes | Não | Uma ferramenta dedicada de TTS oferece duração e texto mais previsíveis. |
| Capítulo de audiolivro | Não | O Suno não publicou especificações sobre duração, continuidade ou pronúncia do Speech. |
| Música usando sua própria voz verificada | Use o Voices | O Voices é um recurso separado do Suno para criar músicas com um perfil de voz reutilizável. |
O Suno anunciou o Speech em 1º de outubro de 2026, após um teste limitado, e depois abriu o beta para todos. As notas oficiais de versão listam o recurso na web, no iOS e no Android, mas o anúncio não informa preço específico em créditos, cota por plano, duração máxima, lista de idiomas compatíveis, especificação de arquivo ou API para o Speech.
O que o Suno Speech beta gera
O Suno Speech beta gera voz falada e música de fundo original como uma única faixa coesa. O usuário fornece uma ideia, um poema ou um roteiro e descreve tanto a voz desejada quanto o estilo musical, de acordo com a publicação de lançamento do Suno.
Speech é um modo identificado dentro do Create, desenvolvido para gerar conteúdo falado. Entre os exemplos do Suno estão histórias para dormir com piano suave, discursos motivacionais acompanhados de bateria de estádio e notas de voz com trilha sonora.
A indicação de beta não é mero detalhe. O Suno afirma que sotaques britânicos solicitados podem se aproximar do sotaque australiano e voltar a mudar, enquanto pausas dramáticas podem ficar excessivas. Esses alertas oficiais tornam o Speech inadequado para publicação sem supervisão, mesmo quando a primeira geração parece convincente.
Uma discussão inicial no r/SunoAI destacou problemas audíveis na própria demonstração do Suno, e não em um teste independente de produção. O usuário u/TheWeaverofDreams escreveu:
“Para uma demonstração, isso é preocupantemente ruim.”
A reação é anedótica, mas está alinhada com a instabilidade de sotaque e ritmo documentada pelo Suno.
Como criar uma faixa falada no Suno
O passo a passo abaixo segue a experiência atual do Create na web e em dispositivos móveis, mas pode mudar durante o beta.
- Abra o Create no Suno pela web, no iOS ou no Android e selecione Speech. Atualize o aplicativo móvel se a opção não aparecer.
- Cole um roteiro curto ou digite uma ideia. Para ter controle sobre o texto, use o roteiro já finalizado em vez de pedir que o Suno escreva por você.
- Descreva o narrador de forma concreta: faixa etária, textura vocal, emoção, sotaque, ritmo e forma de interpretação. Não peça a voz de uma pessoa real se você não tiver autorização para usá-la.
- Descreva a trilha sonora separadamente: instrumentos, clima, intensidade e o quanto ela deve ficar ao fundo da voz.
- Gere mais de uma versão. O Speech ainda está em beta, então uma segunda tentativa costuma ser mais útil do que acrescentar uma longa lista de instruções corretivas.
- Compare o resultado com o texto original antes de publicar. Verifique palavras omitidas ou alteradas, nomes, números, mudanças de sotaque, pausas longas, equilíbrio entre voz e música e o encerramento.
Escreva de um jeito que soe como fala
Um texto com estrutura de fala reduz os sinais que podem levar a interpretação para o canto. Prefira frases curtas, use a pontuação para indicar respiração, separe as ideias com quebras de parágrafo e elimine rimas no fim dos versos ou refrões repetidos, a menos que você queira uma performance ritmada.
Um prompt curto para começar:
Roteiro:
[Cole o texto exato da fala em parágrafos curtos.]
Voz:
Narrador adulto, caloroso, íntimo e conversacional, ritmo constante,
pronúncia clara, emoção contida.
Trilha sonora:
Piano feltro esparso e textura ambiente suave, sem melodia principal,
voz em primeiro plano na mixagem, encerramento delicado.
Os campos de voz e trilha sonora devem explicar o que você quer produzir, não apenas o que deseja evitar. Um pedido como “narração documental tranquila, ritmo lento, piano discreto ao fundo” dá ao modelo um objetivo mais claro do que repetir “não cante”.
Como obter uma fala limpa ou reduzir a trilha sonora
O Suno Speech pode tentar gerar apenas fala, mas a publicação de lançamento do Suno apresenta o produto principalmente como uma combinação de fala e música original. O arquivo de notícias do SunoAI descreve uma configuração beta que funciona: desative a música de fundo, arraste Variety totalmente para a esquerda e inclua No background music. na instrução de tom.
Encare essa combinação como uma solução alternativa, não como uma especificação oficial. A mesma fonte relatou inicialmente que a música continuava aparecendo mesmo com o controle de música de fundo desligado, e o Suno não documentou nenhuma garantia de saída com voz isolada. Se uma faixa vocal limpa for obrigatória, uma ferramenta dedicada de TTS é a opção mais segura.
Se a ideia for ter música mínima, mas não eliminá-la completamente, peça uma base discreta e uma mixagem com a voz em primeiro plano. Assim, você preserva a principal vantagem do recurso e reduz a chance de um arranjo muito ativo encobrir consoantes ou competir com as pausas.
Speech, Voices ou TTS dedicado?
O Suno Speech, o Suno Voices e as ferramentas dedicadas de TTS resolvem problemas diferentes. Escolha com base no resultado necessário, não apenas porque os três recursos envolvem uma voz gerada.
| Opção | Função principal | Identidade usada como entrada | Melhor aplicação | Principal limitação |
|---|---|---|---|---|
| Suno Speech | Gerar uma performance falada com trilha sonora original | Descrição da voz em um prompt | Histórias, poemas, meditações e narrações experimentais | Variações de pronúncia, sotaque e ritmo no beta |
| Suno Voices | Colocar sua própria voz reutilizável em músicas geradas | Gravação ou upload verificado | Criação de músicas e performances cantadas personalizadas | Fluxo separado, restrições de idade e região |
| TTS dedicado | Renderizar texto como fala controlada | Voz padrão ou voz personalizada autorizada | Tutoriais, acessibilidade, narrações longas e voice-overs sincronizados | A música normalmente exige uma etapa de produção separada |
O guia de configuração do Suno Voices exige uma gravação de origem de 15 segundos a 4 minutos, permite selecionar os dois melhores minutos e verifica a identidade com uma frase falada indicada pelo sistema. O Voices é restrito a usuários com 18 anos ou mais e pode não estar disponível em alguns locais. Esses controles não comprovam que uma voz salva possa ser selecionada dentro do Speech; a documentação atual do Suno apresenta os dois como recursos separados.
Perguntas frequentes sobre o Suno Speech beta
O Suno Speech beta já está disponível?
Sim. O Suno anunciou o beta público em 1º de outubro de 2026 e afirma que o Speech está disponível para todos na web e em dispositivos móveis após um teste limitado.
O Suno Speech é gratuito?
O Suno diz que o beta está aberto para todos, mas os materiais de lançamento não informam um custo específico em créditos nem uma cota separada para o plano gratuito. Confira a tela do Create antes de iniciar um projeto em lote, porque estar disponível não significa necessariamente ter gerações ilimitadas.
O Suno Speech consegue criar voz sem música?
Ele pode tentar gerar apenas fala por meio do controle de música de fundo. Um teste da comunidade também recomenda deixar o Variety no mínimo e incluir No background music. na instrução de tom. O Suno não promete uma saída vocal isolada de forma consistente, portanto não monte um fluxo de produção baseado nesse comportamento sem testá-lo antes.
Posso usar minha própria voz no Suno Speech?
O Suno documenta perfis de voz pessoais no recurso separado Voices, que verifica uma gravação antes de usá-la em músicas geradas. A documentação atual do Speech não confirma que um perfil de voz salvo possa ser usado como narrador.
O Suno Speech tem uma API?
O anúncio do Suno em 1º de outubro e as notas de versão não anunciam uma API do Speech. O recurso é documentado pelas experiências do Create na web e em dispositivos móveis.
Posso usar o Suno Speech comercialmente?
O anúncio do Speech não informa termos específicos para uso comercial. Consulte os termos atuais do plano do Suno para a conta e o conteúdo gerado antes de publicar, especialmente porque os direitos sobre resultados de planos gratuitos e pagos do Suno já foram diferentes.
Para um primeiro teste, comece com 100 a 150 palavras, música discreta e duas gerações. Continue usando o Suno Speech quando a trilha expressiva for mais importante do que uma interpretação exata; migre para TTS assim que correção, sincronização ou isolamento limpo da voz se tornarem a prioridade.