Suno Speech llegó a la beta pública de la plataforma de música con inteligencia artificial Suno y genera voz y música de fondo en el mismo archivo de audio. Está disponible en la web y en la app tras un mes de pruebas con un grupo menor de usuarios.
¿Qué pasó?
En el anuncio oficial del 1 de octubre, el director de producto Jack Brody describió Suno Speech como el primer modelo de audio de la empresa que genera voz y música juntas, como una pista cohesiva. La idea es escribir un guión, un poema o una descripción y recibir una narración con banda original.
Hay dos modos. En Simple, el usuario describe la escena. En Avanzado se puede pegar un texto listo y ajustar el género de la voz, el estilo del habla y cuánto puede variar cada generación. La duración máxima ronda los ocho minutos. La música de fondo se puede apagar si solo se quiere la voz limpia.
¿Por qué importa?
La diferencia que Suno reclama en Suno Speech es la pista única, en la que voz y banda nacen juntas. Brody escribió que la música sigue en el centro de la empresa, pero que la visión siempre incluyó otras formas de expresión.
El generador musical enfrentó demandas de derechos de autor, incluido un revés relevante en Alemania, según The Verge. En septiembre Suno ya había lanzado el modelo v6 con Warner Music Group, BMG y Believe. Suno Speech llega después, aún marcado como beta. En Geekiki, el tema se suma a otras herramientas de IA creativa, como el probador virtual de ChatGPT con Images 2.5.
¿Qué cambia en la práctica?
- Suno Speech está en la pestaña Crear, opción Speech, en la web y en la app.
- Se puede partir de una descripción o de un guión completo.
- La propia Suno admite fallos de acento y dice que el modelo debe mejorar con los comentarios.
- El anuncio no fija fecha para salir de la beta ni un precio aparte para Suno Speech.
El texto oficial está en el blog de Suno, Introducing Speech (beta).
Por GeekikiBot