
Suno ist tot. Ich hab mir meinen eigenen Musikgenerator gebaut.
Zumindest für mich ist Suno tot. Ich brauch den Dienst nicht mehr, denn ich hab mir meinen eigenen Musikgenerator gebaut. Läuft komplett lokal auf meinem Mac. Kein Abo, kein Limit, keine Cloud.
Der Auslöser
Suno hat vor Kurzem die Downloads gekappt: zwanzig Stück im Monat. Vorher unbegrenzt, jetzt zwanzig. Und da muss man echt mal drauf rumhacken, denn das ist eine Frechheit. Ich zahl seit Monaten für den Dienst, und jetzt, ohne dass ich irgendwas geändert hab, wird die Leistung einfach weniger. Gleicher Preis, weniger Gegenleistung. Da war für mich klar: Dann mach ich’s eben selbst.
Was ich gebaut habe
Suno kennst du wahrscheinlich: KI-Musik aus Stil-Tags und Text, in der Cloud, mit Abo, jetzt eben auch mit Downloadlimit. Ich wollte wissen: Geht das auch komplett bei mir zu Hause? Ohne dass irgendwas irgendwohin geschickt wird, ohne Limit?
Also hab ich mir eine eigene Web-App gebaut, mit einer offenen KI namens ACE-Step als Motor. Die Oberfläche ist meine eigene, im Browser, läuft nur auf meinem Rechner. Ich geb Stil-Tags ein, zum Beispiel „trip hop, verträumt, kinoreif“, dazu Songtext oder einfach „Instrumental“ – und ab geht’s.
Dahinter arbeiten zwei Modelle: ein Sprachmodell mit 1,7 Milliarden Parametern, das meinen Text versteht und den Song plant, und ein zweites Modell, das daraus tatsächlich Audio synthetisiert. Zusammen sind das etwa acht Gigabyte an Modellen, einmal heruntergeladen, und die laufen nie wieder über Internet.
Probier die Oberfläche selbst aus
Das hier ist die echte Bedienoberfläche meiner App, zum Ausprobieren direkt im Browser. Regler ziehen, Würfel klicken, Stil-Chips antippen – alles funktioniert. Nur der GENERIEREN-Knopf ist deaktiviert, dafür liegen zwei echte Songs aus der App schon in der Bibliothek zum Anhören.
Echte Songs erzeugt nur die App auf deinem eigenen Rechner – dafür brauchst du das GitHub-Repository von unten.
Die App gibt es jetzt auf GitHub, kostenlos und quelloffen: github.com/agent-cue/music-generator. Dann kann sich jeder lokal seine eigene Musik basteln.
Noch nie von GitHub gehört? Kein Problem.
GitHub ist im Grunde eine riesige Online-Bibliothek für Programm-Code. Leute wie ich laden dort ihre Projekte hoch, kostenlos, und jeder kann sie sich herunterladen. Du brauchst dafür kein Konto und musst nichts installieren, um dir mein Projekt erst mal anzusehen.
So kommst du an die Dateien, ganz ohne Vorwissen:
- Öffne den Link oben im Browser.
- Klick oben rechts auf den grünen Knopf „Code“.
- Wähl „Download ZIP“.
- Entpack die heruntergeladene Datei irgendwo, zum Beispiel in deinem Benutzerordner.
Fertig, das ist der komplette Projektordner. Alles Weitere, also Installation und erster Song, erklär ich Schritt für Schritt in der Installationsanleitung, die im Projekt dabei ist, verständlich egal mit welchem Wissensstand du startest.
Der Trick mit dem Chip
Mein Mac hat einen M4-Chip mit extra Hardware für KI-Berechnungen. Aber: Das Sprachmodell liefert auf dieser Hardware bei mir kompletten Kauderwelsch. Deshalb läuft bei mir das Sprachmodell auf dem normalen Prozessor, dauert dann etwa zwanzig Sekunden, und nur die Musik-Synthese läuft auf der schnellen KI-Hardware.
Ich hab das gegengecheckt: Die Ergebnisse von beidem sind sich zu 95 % ähnlich, nur eben schneller. Faustregel bei mir: Ein Song mit anderthalb Minuten Länge braucht ungefähr vier Minuten Rechenzeit.
Der Extremtest: 50 statt 20
Und jetzt der Teil, der mir am meisten Spaß gemacht hat. Ich kann bis zu fünfzig Varianten von einem Song auf einmal in die Warteschlange stellen. Fünfzig – nicht zwanzig im Monat, sondern fünfzig auf einen Schlag. Über Nacht rechnen lassen, morgens durchhören.
Ich hab getestet, was passiert, wenn ich an zwei Reglern drehe: wie viele Rechenschritte das Modell macht, und wie kreativ, also wie „heiß“, es dabei sein darf. Zehn Schritte klingen matschig, kaum Struktur. Fünfzig Schritte sind schon ordentlich. Hundert Schritte machen kaum noch einen Unterschied zu fünfzig, nur teurer. Und bei der Kreativität: niedriger Wert klingt bieder und vorhersehbar, hoher Wert wird schnell schräg. Der Sweet Spot lag bei mir klar in der Mitte.
Jeder einzelne Song speichert übrigens automatisch Stil, Text, den Zufalls-Seed und alle Regler-Werte. Ich kann also jeden Treffer exakt nachbauen.
Ganz ehrlich: das Fazit
In meinen ersten Tests war’s deutlich schwieriger, richtig hochwertige Musik aus meiner lokalen Version rauszuholen. Aber nicht unmöglich. Die zehn Euro im Monat, die ich mir bei Suno spare, investier ich jetzt eben in meine eigene Zeit. Dafür kann ich mir fünfzig Songs gleichzeitig machen lassen und bin nicht auf zwanzig Downloads im Monat limitiert. Für mich ist der Deal das wert.
Würdet ihr euch KI-Musik lieber lokal selbst bauen, auch wenn’s mehr Arbeit macht, oder bleibt ihr bei der bequemen Cloud-Lösung, Downloadlimit hin oder her?
Das ausführliche Video dazu folgt in Kürze – ich verlinke es hier, sobald es fertig ist.


