Suno estrena Speech: voz hablada y música generadas en la misma pista
La compañía abre a todo su público la beta de un modelo que genera locución y fondo musical en una sola pista; llega un mes después de presentar v6 «en asociación con la industria musical».
Suno abre la beta pública de Speech, lo que llama «el primer modelo de audio que genera voz y música juntas como una pista coherente»: el usuario escribe un texto —un poema, un guion, un mensaje— y describe la voz y el estilo musical, y el sistema genera la locución sobre música original. Llevaba un mes en prueba con un grupo reducido de usuarios.
Qué ha ocurrido
Suno ha anunciado en su blog oficial la apertura de la beta pública de Speech, un modelo de audio que genera habla y música de fondo juntas como una sola pista coherente. La entrada la firma su jefe de producto, Jack Brody, y describe el producto como extensión natural de la plataforma: «el primer modelo de audio que genera voz y música juntas como una pista coherente». El flujo es el habitual en Suno: se escribe una idea, un poema o un texto propio y se describe la voz y el estilo musical deseados. La compañía admite que la beta es beta: los acentos británicos «se van a Australia y vuelven», las pausas dramáticas pueden ser muy dramáticas.
Por qué importa
El audio hablado con música integrada es un terreno nuevo para el consumo casual —narración personal, felicitaciones, historias para dormir, pódcast con banda sonora— y para él Suno empuja su propuesta de «entretenimiento creativo», aquella ola en la que la compañía cree que definirá la próxima ola de la tecnología de consumo para creadores. Para los modelos de negocio de voz (ElevenLabs, valorada esta semana en 22.000 millones según información contrastada) y para el de música (el propio Suno), la frontera se difumina: un solo modelo cubre las dos tareas. La jugada amplía la exposición legal y contractual de Suno, que aún negocia licencias de Catálogo con las mayores discográficas tras las demandas de 2024, ahora también con voz generada.
Qué cambió
Qué sabemos · qué no
Confirmado
- La ficha oficial de Suno (1 de octubre de 2026, firmada por Jack Brody, Chief Product Officer) describe el producto y su apertura pública tras un mes de prueba con usuarios.
- La entrada lo enmarca en su «visión» de otras formas de expresión además de la música, y enmarca v6, presentado por el consejero delegado Mikey Shulman en «asociación con la industria musical».
- La cobertura de The Verge (3 de octubre) confirma la disponibilidad en beta para todo el público.
- La presentación oficial es del blog de Suno (1-oct-2026, CPO Jack Brody), tras un mes de pruebas con usuarios.
- El anuncio de Suno posiciona Speech como modelo pionero (afirmación de la compañía, no verificada de forma independiente).
- The Verge confirma el despliegue en beta pública el 3 de octubre.
Todavía no
- Qué modelo base usa Speech y si entrena con voces de terceros o solo con las generadas.
- Cómo se aplican a la voz las protecciones antideepfake de voz que Suno y sus rivales han prometido.
- Precios y límites de uso en la beta.
- El origen de los datos de entrenamiento de voces.
- Restricciones de seguridad específicas contra la clonación de voz en Speech.
- Modelo de negocio de la función.
Para ir al grano técnico
- → anuncio
Qué vigilamos ahora
La respuesta de las discográficas con las que Suno negocia licencias y si aparecen casos virales de suplantación de voz que presionen al regulador.
Aceptación entre usuarios y las primeras denuncias de uso suplantador de voces reales.
Fuentes
Naturaleza de la afirmación principal: Anuncio de la empresa. Fuente primaria consultada y verificable.
- Suno — blog oficial · nivel 1 · primaria · consultada 4 oct 2026
- The Verge · nivel 2 · medio · consultada 4 oct 2026
Se relaciona con
- Google abre a todo el público su verificador de contenido con marca de agua SynthID · 9 oct 2026
- Google estrena Playground, su plataforma para crear juegos escribiendo lo que quieres · 8 oct 2026
- Microsoft estrena el Surface Laptop Ultra con chip Nvidia RTX Spark para correr agentes en local · 8 oct 2026
- OpenAI pone anuncios visuales junto a las imágenes que genera ChatGPT · 6 oct 2026