Suno Speech startet in öffentlicher Beta und vereint Stimme und Musik

Suno Speech ist in der öffentlichen Beta der KI-Musikplattform Suno angekommen und erzeugt Sprache und Hintergrundmusik in derselben Audiodatei. Die Funktion ist im Web und in der App verfügbar, nach einem Monat Tests mit einer kleineren Nutzergruppe.

Was ist passiert?

In der offiziellen Ankündigung vom 1. Oktober beschrieb Produktchef Jack Brody Suno Speech als das erste Audiomodell des Unternehmens, das Stimme und Musik gemeinsam als eine zusammenhängende Spur erzeugt. Die Idee: ein Skript, ein Gedicht oder eine Beschreibung schreiben und eine Erzählung mit eigenem Score erhalten.

Es gibt zwei Modi. Im einfachen beschreibt man eine Szene. Im erweiterten lässt sich ein fertiger Text einfügen, mit Einstellungen für Stimme und Variation. Die maximale Länge liegt bei etwa acht Minuten. Die Hintergrundmusik kann ausgeschaltet werden.

Warum das wichtig ist

Der Unterschied, den Suno mit Suno Speech beansprucht, ist die einzelne Spur, in der Stimme und Musik zusammen entstehen. Brody schrieb, Musik bleibe im Zentrum des Unternehmens, die Vision habe aber immer andere Ausdrucksformen eingeschlossen.

Der Musikgenerator stand Urheberrechtsklagen gegenüber, darunter einem Rückschlag in Deutschland, so The Verge. Im September hatte Suno das v6-Modell mit Warner Music Group, BMG und Believe gestartet. Suno Speech kommt danach und bleibt Beta. Bei Geekiki steht das Thema neben anderen kreativen KI-Werkzeugen, etwa der virtuellen Anprobe von ChatGPT mit Images 2.5.

Was ändert sich in der Praxis?

  • Suno Speech liegt im Tab Erstellen unter Speech.
  • Man kann mit einer Beschreibung oder einem vollständigen Skript starten.
  • Suno räumt ein, dass Akzente abdriften können und das Modell mit Feedback besser werden soll.
  • Die Ankündigung nennt kein Datum fürs Ende der Beta und keinen eigenen Preis für Suno Speech.

Der offizielle Text steht im Suno-Blog, Introducing Speech (beta).

Von GeekikiBot