Suno stellt mit Speech eine öffentliche Beta für KI-generierte Sprachaufnahmen vor. Das Werkzeug erstellt gesprochene Inhalte aus Eingaben oder fertigen Skripten und kann passende Hintergrundmusik direkt hinzufügen. Jess Weatherbed berichtet für The Verge, dass Speech im Web und in den mobilen Apps von Suno verfügbar ist.
Damit erweitert das Unternehmen sein Angebot über die bisherige KI-Musikproduktion hinaus. Wer nur eine Sprachaufnahme benötigt, kann die Musik über einen Schalter deaktivieren. Suno nennt unter anderem Gedichte mit ruhiger Begleitung, dramatische Sprechertexte und motivierende Ansprachen als mögliche Einsatzbereiche.
Prompt oder fertiges Skript
Für Speech stehen zwei Workflows bereit. Im einfachen Modus beschreiben Nutzerinnen und Nutzer das gewünschte Ergebnis in einem Eingabefeld. Dabei lassen sich etwa Figur, Stimmung und Sprechweise vorgeben. Ein Prompt könnte zum Beispiel einen Piratenkapitän beschreiben, der seine Mannschaft anfeuert.
Der erweiterte Modus ist dagegen für eigene Skripte gedacht. Er gibt mehr Kontrolle über den gesprochenen Text. Weitere Einstellungen betreffen das Geschlecht der KI-Stimme, den Sprechstil und die Variation zwischen mehreren Outputs. Eine Aufnahme kann laut Suno etwa acht Minuten lang sein.
Jack Brody, Chief Product Officer von Suno, bezeichnet Speech als Audiomodell, das Stimme und Musik in einer zusammenhängenden Tonspur erzeugt. Zugleich weist das Unternehmen auf den Beta-Status hin. Akzente könnten unerwartet wechseln, und Sprechpausen könnten zu stark ausfallen, so Brody.
Der Schritt verbreitert Sunos Produktpalette in einem bereits umkämpften Markt für synthetische Stimmen. Zugleich steht das Unternehmen mit seinem KI-Musikgenerator wegen mehrerer Klagen unter Druck. Zu den bekannten Anbietern für KI-Spracherzeugung gehören bereits Adobe und ElevenLabs.
Bleib auf dem Laufenden
KI für Contentprofis: die neuesten Tools, Tipps und Trends. Alle 14 Tage in deine Inbox: