Suno Speech beta convierte un guion en una pista narrada con música original, pero no es un motor de texto a voz de precisión. Resulta útil para piezas breves y expresivas en las que la música forma parte del resultado; si necesitas repetir exactamente cada palabra, pausa y pronunciación, es mejor recurrir a una herramienta TTS dedicada.
¿Suno Speech encaja en tu proyecto?
Suno Speech funciona mejor para narraciones cortas con música que para producir locuciones perfectamente controladas. La beta de octubre de 2026 destaca cuando se tolera una interpretación algo impredecible y se queda corta en proyectos con requisitos estrictos de texto, duración o consistencia de la voz.
| Proyecto | ¿Usar Suno Speech? | Motivo |
|---|---|---|
| Cuento para dormir con piano suave | Sí | Genera la narración y una banda sonora original en una sola creación. |
| Meditación o poema dramático | Sí, después de revisarlo | El ritmo expresivo encaja con el formato, aunque las pausas y los acentos pueden variar. |
| Monólogo breve de un personaje | Pruébalo | La interpretación puede ser aprovechable, pero no se garantiza una pronunciación exacta. |
| Tutorial de producto con códigos de tiempo | No | Una herramienta TTS dedicada ofrece una duración y un texto más repetibles. |
| Capítulo de audiolibro | No | Suno no ha publicado especificaciones sobre la duración, la continuidad ni la pronunciación en Speech. |
| Canción con tu propia voz verificada | Usa Voices | Voices es una función independiente de Suno para crear canciones con un perfil de voz reutilizable. |
Suno anunció Speech el 1 de octubre de 2026, después de una prueba limitada, y posteriormente abrió la beta a todo el mundo. Las notas de lanzamiento oficiales indican que está disponible en la web, iOS y Android, pero el anuncio no especifica el precio en créditos de Speech, la cuota por plan, la duración máxima, los idiomas compatibles, las características de los archivos ni la existencia de una API.
Qué genera Suno Speech beta
Suno Speech beta genera voz hablada y música de fondo original como una pista cohesionada. El usuario aporta una idea, un poema o un guion, y describe tanto la voz que busca como el estilo musical, según explica la publicación de lanzamiento de Suno.
Speech es un modo de Create diseñado para producir contenido hablado. Entre los ejemplos de Suno hay cuentos para dormir sobre un piano suave, discursos motivacionales con percusión de estadio y notas de voz con música.
La etiqueta de beta no es un simple trámite. Suno advierte que un acento británico solicitado puede desplazarse hacia el australiano y volver después, y que las pausas dramáticas pueden acabar siendo excesivas. Estas advertencias oficiales hacen que Speech no sea adecuado para publicar sin supervisión, aunque el primer resultado parezca convincente.
Una de las primeras conversaciones en r/SunoAI se centró en fallos audibles de la propia demostración de Suno, no en una prueba de producción independiente. El usuario u/TheWeaverofDreams escribió:
“Para ser una demo, esto es preocupantemente malo”.
La reacción es anecdótica, pero coincide con la inestabilidad de acentos y ritmo que Suno documenta.
Cómo crear una pista hablada en Suno
El proceso siguiente refleja la experiencia actual de Create en la web y en dispositivos móviles, aunque puede cambiar durante la beta.
- Abre Create en Suno desde la web, iOS o Android y selecciona Speech. Actualiza la aplicación móvil si no aparece Speech.
- Pega un guion breve o introduce una idea. Si quieres controlar exactamente el texto, usa el guion terminado en lugar de pedirle a Suno que lo redacte.
- Describe al hablante con términos concretos: rango de edad, textura vocal, emoción, acento, velocidad y forma de interpretar. No nombres a una persona real cuya voz no tengas permiso para utilizar.
- Describe la banda sonora por separado: instrumentación, ambiente, intensidad y cuánto debe quedar por detrás de la voz.
- Genera más de una toma. Speech sigue en fase beta, así que una segunda toma suele ser más útil que añadir una larga lista de instrucciones correctivas.
- Escucha el resultado comparándolo con el texto original antes de publicarlo. Comprueba si faltan o han cambiado palabras, nombres o cifras; revisa los cambios de acento, las pausas largas, el equilibrio entre voz y música y el final.
Escribe como si el texto fuera a decirse en voz alta
Un texto con ritmo hablado reduce las señales que pueden llevar la interpretación hacia el canto. Escribe frases cortas, usa la puntuación para marcar la respiración, separa las ideas con saltos de párrafo y elimina las rimas finales o los estribillos repetidos, salvo que busques una interpretación rítmica.
Este es un buen punto de partida:
Guion:
[Pega el texto hablado exacto en párrafos cortos.]
Voz:
Narrador adulto de tono cálido, cercano y conversacional, ritmo estable,
pronunciación clara y emoción contenida.
Banda sonora:
Piano de fieltro escaso y textura ambiental suave, sin melodía principal,
voz al frente en la mezcla y final delicado.
Los apartados de voz y banda sonora deben describir lo que quieres obtener, no limitarse a enumerar lo que debe evitarse. Una instrucción como “narración documental tranquila, ritmo lento, piano escaso de fondo” ofrece al modelo un objetivo más claro que repetir “no cantes”.
Cómo conseguir una voz limpia o reducir la música
Suno Speech puede intentar generar una voz limpia, pero la publicación de lanzamiento de Suno presenta principalmente el producto como una combinación de voz hablada y música original. El archivo de noticias de SunoAI describe una configuración beta que funciona: desactivar la música de fondo, mover Variety completamente hacia la izquierda y añadir No background music. a la instrucción de tono.
Considera esta combinación un recurso provisional, no una especificación garantizada. La misma fuente observó inicialmente que la música podía aparecer aunque el control de música de fondo estuviera desactivado, y Suno no ha documentado ninguna garantía de salida con la voz aislada. Si necesitas obligatoriamente una pista de voz limpia, una herramienta TTS dedicada es una opción más segura.
Si quieres música mínima, pero no eliminarla por completo, pide una base discreta y una mezcla con la voz en primer plano. Así conservas la principal ventaja de la función y reduces el riesgo de que un arreglo demasiado activo tape las consonantes o compita con las pausas.
¿Speech, Voices o una herramienta TTS dedicada?
Suno Speech, Suno Voices y las herramientas TTS dedicadas resuelven problemas distintos. La elección debe depender del resultado que necesitas, no del hecho de que las tres trabajen con una voz generada.
| Opción | Función principal | Identidad de entrada | Mejor uso | Principal limitación |
|---|---|---|---|---|
| Suno Speech | Generar una interpretación hablada con música original | Descripción de voz mediante prompt | Historias, poemas, meditaciones y narraciones experimentales | Variabilidad beta en pronunciación, acento y ritmo |
| Suno Voices | Incorporar tu propia voz reutilizable a canciones generadas | Grabación o archivo subido y verificado | Canciones personalizadas y creación musical | Flujo independiente y restricciones de edad y región |
| TTS dedicado | Convertir texto en voz controlada | Voz de catálogo o voz personalizada autorizada | Tutoriales, accesibilidad, narraciones largas y locuciones sincronizadas | La música suele requerir un paso de producción separado |
La guía de configuración de Suno Voices exige una grabación de entre 15 segundos y 4 minutos, permite seleccionar los dos mejores minutos y verifica la identidad mediante una frase hablada indicada por el sistema. Voices está limitado a usuarios de 18 años o más y puede no estar disponible en algunas ubicaciones. Estos controles no demuestran que una Voice guardada pueda seleccionarse dentro de Speech; la documentación actual de Suno presenta ambas funciones por separado.
Preguntas frecuentes sobre Suno Speech beta
¿Suno Speech beta está disponible?
Sí. Suno anunció la beta pública el 1 de octubre de 2026 y afirma que Speech está disponible para todo el mundo en la web y en dispositivos móviles tras una prueba limitada.
¿Suno Speech es gratis?
Suno afirma que la beta está abierta a todo el mundo, pero sus materiales de lanzamiento no publican un coste específico en créditos para Speech ni una cuota independiente para el plan gratuito. Comprueba la pantalla de Create antes de iniciar un proyecto por lotes: que esté disponible no significa necesariamente que la generación sea ilimitada.
¿Puede Suno Speech crear voz sin música?
Puede intentar generar voz limpia mediante el control de música de fondo. Una prueba de la comunidad también recomienda dejar Variety al mínimo y añadir No background music. a la instrucción de tono. Suno no ha prometido una salida de voz aislada y consistente, así que no conviene basar un flujo de producción en ese comportamiento sin probarlo antes.
¿Puedo usar mi propia voz en Suno Speech?
Suno documenta los perfiles de voz personales dentro de la función independiente Voices, que verifica una grabación antes de utilizarla en canciones generadas. La documentación actual de Speech no confirma que un perfil de Voice guardado pueda usarse como narrador.
¿Suno Speech tiene API?
El anuncio de Suno del 1 de octubre y sus notas de lanzamiento no anuncian una API de Speech. La función está documentada a través de las experiencias de Create en la web y en dispositivos móviles.
¿Puedo usar Suno Speech con fines comerciales?
El anuncio de Speech no establece condiciones específicas para el uso comercial. Revisa las condiciones vigentes del plan de Suno aplicables a tu cuenta y al contenido generado antes de publicarlo, especialmente porque los derechos sobre los resultados de los planes gratuito y de pago han sido distintos.
Para una primera prueba, empieza con entre 100 y 150 palabras, música contenida y dos generaciones. Quédate con Suno Speech cuando la expresividad y la música sean más importantes que una interpretación exacta; pásate a TTS en cuanto la corrección, la sincronización o el aislamiento limpio de la voz se conviertan en la prioridad.