KI

Suno liest jetzt Gedichte vor und komponiert die Musik dazu in einem Durchgang

Susan Hill
Fügen Sie uns bei Google hinzu

Suno, die App, die mit einzeiligen Prompts Songs erstellt, geht jetzt einen ungewöhnlicheren Schritt: Sie liest deine Worte vor und komponiert gleichzeitig die passende Musik dazu. Gib ein Gedicht, einen Trinkspruch oder eine Gute-Nacht-Geschichte ein, beschreibe die gewünschte Stimme und Stimmung – und Speech liefert einen Track, in dem Erzählung und Musik gemeinsam entstanden sind, statt erst nachträglich übereinandergelegt zu werden. Bei selbst produzierten Audiobeiträgen war selten die Stimme das Problem. Schwieriger war es, Stimme und Musik so klingen zu lassen, als gehörten sie in denselben Raum.

Wer Hochzeitsreden, Kurzvideos, geführte Meditationen oder Podcast-Intros produziert, kann sich damit einen Arbeitsschritt sparen, für den sonst meist zwei Apps und eine Schnitt-Timeline nötig sind. Bisher musste man die Erzählung an einem Ort aufnehmen, andernorts lizenzfreie Hintergrundmusik suchen und anschließend die Lautstärke so lange anpassen, bis die Musik die Worte nicht mehr übertönte. Sunos Versprechen: Ein einziges Modell übernimmt beide Aufgaben. Der Soundtrack wird also rund um die Sprache komponiert, statt nachträglich daruntergelegt zu werden.

Speech bietet zwei Modi. Im Simple-Modus beschreibst du eine Idee – etwa einen Piratenkapitän, der seine Mannschaft anfeuert – und Suno verfasst den Text und spricht ihn ein. Im Advanced-Modus kannst du dein eigenes Skript verwenden und zusätzlich das Geschlecht der Stimme, den Sprechstil und den Grad der Variation zwischen den einzelnen Aufnahmen festlegen. Die Tracks können bis zu etwa acht Minuten lang sein – genug für eine ganze Gute-Nacht-Geschichte oder eine kurze Meditation. Musik ist standardmäßig aktiviert, lässt sich aber per Schalter entfernen, wenn du nur die Erzählung möchtest.

Jack Brody, Sunos Chief Product Officer, bezeichnet Speech als das erste Audiomodell, das Stimme und Musik gemeinsam zu einem stimmigen Track verbindet. Synthetische Erzählstimmen an sich sind nichts Neues. ElevenLabs, Adobe und Google DeepMind bieten allesamt Text-to-Speech an, das menschlich klingt. Den Soundtrack müssen Nutzerinnen und Nutzer jedoch selbst erstellen und von Hand abmischen. Suno kommt aus der entgegengesetzten Richtung: ein Musikunternehmen, das eine Stimme ergänzt, statt ein Sprachunternehmen, das Musik hinzufügt.

Die Schwächen sind durchaus vorhanden, und Suno spricht einige davon selbst an. Das Unternehmen warnt, dass ein britischer Akzent plötzlich nach Australien abdriften und wieder zurückwechseln kann – und dass dramatische Pausen mitunter sehr dramatisch ausfallen. Einstellungen für die genaue Dauer oder das Timing einzelner Wörter gibt es nicht. Außerdem hat Suno nicht mitgeteilt, ob sich die individuellen Stimmen, die Nutzer bereits für Songs aufnehmen können, auch in Speech verwenden lassen. Welche Sprachen das Feature unterstützt, ist ebenfalls nicht bekannt – eine Lücke, die für Menschen außerhalb englischsprachiger Märkte relevant ist. Auch die Zahl der Credits, die ein vertonter Track kostet, hat das Unternehmen nicht veröffentlicht. Im Gratis-Abo behält Suno laut den üblichen Nutzungsbedingungen die Rechte an den von Nutzern erstellten Inhalten; eine kommerzielle Nutzung ist ausgeschlossen. Wer einen kostenpflichtigen Podcast oder eine Werbeanzeige plant, sollte daher zuerst das Kleingedruckte lesen.

Speech ist seit dem 1. Oktober für alle Suno-Nutzer im Web sowie in den iOS- und Android-Apps verfügbar. Vorausgegangen war eine rund einmonatige Testphase mit einer kleinen Gruppe. Das Feature ist weiterhin als Beta gekennzeichnet, nutzt dieselben Credit-Tarife wie die Songgenerierung, und Suno hat noch keinen Termin für eine fertige Version genannt.

Der Start fällt außerdem mitten in einen Rechtsstreit. Warner Music Group einigte sich im November 2025 mit Suno und lizenzierte dessen Technologie. Universal Music Group und Sony Music reichten jedoch im September eine neue Klage zu den Musikmodellen v6 ein. Sie werfen dem Unternehmen vor, mehr als 60.000 Aufnahmen kopiert zu haben, und fordern gesetzlichen Schadensersatz von bis zu 9 Milliarden Dollar. Der Fall ist vor einem Bundesgericht in Boston anhängig. Die Musik unter deiner Gute-Nacht-Geschichte stammt damit von einem Unternehmen, das sich weiterhin dafür verteidigen muss, wie es gelernt hat, Musik zu machen.

Schlagwörter: , , , , ,

Fügen Sie uns bei Google hinzu

Diskussion

Es gibt 0 Kommentare.