---
title: "Ein KI-Musikprojekt in sechs Phasen: Suno, Claude und Higgsfield"
date: 2026-07-07
author: "Damjan Savić"
canonical: https://damjan-savic.com/de/wissen/ai-music-artist-suno-claude
language: de
keywords: "Suno, Higgsfield, Claude, Prompting, KI-Video, Markenaufbau"
video: https://www.youtube.com/watch?v=C0Ea6XYvoyw
---
# Ein KI-Musikprojekt in sechs Phasen: Suno, Claude und Higgsfield

**Kurz gesagt** — Über 50.000 Streams und 600.000 TikTok-Aufrufe in neun Monaten, bei etwa 15 Euro Werbung am Tag. Sechs Phasen, jedes Mal dieselben: Text, Song, Cover, Upload, Video, Bewerbung. Die Werkzeuge können sich ändern, die Reihenfolge bleibt — und das Cover entstand erst nach vier gescheiterten Anläufen.

---

In neun Monaten sind über 50.000 organische Streams auf SoundCloud und über 600.000 Aufrufe auf TikTok zusammengekommen — bei ein paar Euro Werbebudget am Tag. Ein KI-Künstler, gebaut aus Prompts und aus mir.

Der klassische Weg für eine Veröffentlichung: Studiozeit buchen, einen Produzenten für den Beat bezahlen, jemanden zum Singen holen, ein Cover gestalten lassen, ein Musikvideo drehen, dann Vermarktung — und alle verdienen mit. Tausende Euro und Monate Arbeit für eine einzige Single, bevor sie überhaupt jemand gehört hat.

Der Text darunter ist meine Pipeline zum Nachlesen: sechs Phasen, dieselben bei jeder Veröffentlichung. Am Beispiel meines Tracks **Okean** unter dem Künstlernamen **Desetka**.

![Diagramm · Die sechs Phasen einer Veröffentlichung, in der Reihenfolge, in der sie laufen](/media/website/article/figures/ai-music-artist-suno-claude-phases.avif)

## Werkzeuge

| Werkzeug | Wofür | Hinweis |
| --- | --- | --- |
| Suno | Der Song | Pro oder Premier. Nötig für kommerzielle Rechte und die höhere Ausgabequalität. |
| Claude | Prompts, Coverkonzept, Beschreibungen und Tags | |
| Higgsfield | Bilder und Videogenerierung | Ultra-Plan. |
| Photoshop | Cover-Vorlage | Für ein einheitliches Format über alle Veröffentlichungen. |
| Premiere | Der finale Schnitt | |

## Phase 1 · Text

Ich schreibe alles zuerst in einem einfachen Texteditor. Keine Werkzeuge, keine Vorlagen, nur eine leere Datei — aber immer dieselbe Struktur:

```text
[Instrumental Intro]
[Hook]
[Verse 1]
[Pre-Hook]
[Hook]
[Verse 2]
[Pre-Hook]
[Hook]
[Instrumental Outro]
```

Warum diese Struktur: Sie gibt dem Song eine Form, bevor eine einzige Note existiert. Der Hook wiederholt sich — das ist, was hängen bleibt. Die Strophen tragen die Geschichte. Der Pre-Hook baut die Spannung genau vor dem Drop auf.

Jeder Abschnitt wird in eckigen Klammern ausgezeichnet, denn Suno liest diese Marken. Dazu kommen Angaben zur Ausführung, die ich fast immer setze — etwa `hypnotic melodic delivery`. Das ist die zusätzliche Information darüber, wie der Song klingen soll, nicht nur was drinsteht.

Bei Okean ist der Text auf Serbisch, und der Hook setzt die Stimmung für alles Weitere. Es ist ein Trennungslied, absichtlich schwer.

## Phase 2 · Song

Es gibt zwei Wege, und ich nehme fast immer den zweiten.

**Der schnelle Weg.** Text einfügen, Style-Prompt dazu, ganzen Song generieren. Funktioniert, ist aber der Weg mit der geringsten Kontrolle.

**Der Weg über das Instrumental.** Zuerst nur das Instrumental erzeugen, mit den Styles, nach denen der fertige Song klingen soll. Ein reiner Fokus-Prompt für die Stimmung. Unter „More Options" setze ich dabei:

- Weirdness: 35
- Style Influence: 75

Dann generiere ich weiter, bis der Beat wirklich sitzt. Erst wenn das Instrumental stimmt, kommt Sunos Cover-Funktion zum Einsatz: die Version, die mir gefällt, mit dem inzwischen überarbeiteten Text noch einmal neu.

### Die Iteration

Das ist der Teil, den man von außen nicht sieht. Bei Okean war ich mit der Aussprache einzelner Wörter und mit dem Hook selbst nicht zufrieden. Der Weg dorthin war: mehrfach iterieren, dabei jeweils nur 25 Prozent Audio-Referenz aus der vorherigen Version übernehmen, und jeden Durchgang wieder covern. Wieder. Und wieder. Bis es sitzt.

Danach eine letzte Runde mit normaler Variation Strength als Remaster. Zwischen erster Generierung und Endfassung liegen zweistellig viele Versionen — verschiedene Stile, verschiedene Aussprachevarianten, verschiedene Flows.

## Phase 3 · Cover

Auf Pinterest suche ich nicht nach einem Cover. Ich suche nach einem Gefühl: Licht, Farbe, Stimmung. Ein paar Bilder, die zum Song passen, werden gespeichert.

Für ein einheitliches Erscheinungsbild läuft danach alles durch dieselbe Photoshop-Vorlage: Bild auf 1:1 beschneiden, in das Cover-Projekt kopieren, mittig setzen, gegebenenfalls Kurven und Farben anpassen. Export als PNG.

### Wo es scheiterte

Der Versuch, das Cover stattdessen vollständig in Higgsfield zu erzeugen, ist im Video zu sehen — und er ist gescheitert. Ich schreibe das hier ausdrücklich hin, weil solche Durchläufe in Tutorials üblicherweise herausgeschnitten werden.

Der Ansatz war: ein Bild auf Pinterest finden, Claude bitten, daraus einen sehr detaillierten Prompt zu schreiben, und den in Higgsfield mit Nano Banana Pro beziehungsweise Nano Banana 2 laufen lassen, 4K, Seitenverhältnis 9:16 für das Hochformat.

Was passierte:

1. Erste vier Bilder — falsche Perspektive, falsches Outfit.
2. Screenshot davon an Claude, mit der Anweisung, den Prompt zu korrigieren und die Referenzperson zu beachten. Neuer Prompt, vier weitere Bilder.
3. Das Modell blieb am Referenzbild kleben. Ergebnis unbrauchbar.
4. Wechsel von Nano Banana 2 auf Nano Banana Pro. Dieselben Probleme.

Was am Ende funktioniert hat, war ein anderer Weg: den **Songtext** an Claude geben und daraus einen Prompt schreiben lassen, der zur Stimmung des Stücks passt — statt ein gefundenes Bild nachbauen zu wollen. Das erzeugte Bild ging durch dieselbe Photoshop-Vorlage und wurde das Cover.

Die Lehre daraus ist unspektakulär und trägt trotzdem: Ein Bild rekonstruieren zu wollen, das man woanders gesehen hat, ist eine deutlich schwerere Aufgabe als ein Bild zu erzeugen, das zu einem Text passt.

## Phase 4 · Upload

Vor der Veröffentlichung braucht der Track eine Beschreibung und Tags. Beides kommt aus einem Claude-Chat, der als Vorlage eingerichtet ist: ein bereits veröffentlichter Song mit seiner Beschreibung und seinen Tags als Beispiel, dann der neue Songtext und die Bitte um dasselbe.

Wer das nachbauen will, richtet sich diesen einen Chat einmal ein — mit den eigenen Songnamen, Tags und Styles als Muster — und benutzt ihn danach für jede Veröffentlichung.

Der Upload auf SoundCloud selbst ist geradeaus: Track hochladen, Titel, Link, Hauptkünstler, Genre. Die Tags müssen dabei einzeln von Hand eingetragen werden, was der mühsamste Teil des ganzen Ablaufs ist. Dann Beschreibung und Artwork.

Zwei Dinge, die sich lohnen zu wissen:

- Veröffentlichungen lassen sich planen, statt sofort live zu gehen.
- Mit SoundCloud Pro lässt sich die **Audiodatei später ersetzen**, ohne die Statistik zu verlieren. Streams, Kommentare und Reaktionen bleiben am Track hängen. Wer noch an einer Endfassung arbeitet, kann also veröffentlichen und später nachbessern.

## Phase 5 · Video

Auf TikTok bewegt sich nicht der Song, sondern das Bild. Ausgangspunkt ist das Cover oder wieder Pinterest.

Der einfache Weg in Higgsfield: Videogenerierung öffnen, Preset `3D renderer` mit Seedance 2.0 fast, ein Bild hochladen — und das war es. Kein Prompt. 720p, sieben Sekunden, 9:16, etwa 30 Generierungstoken. Der Rest ist Versuch und Irrtum: manchmal braucht es mehrere Anläufe, bis eines dabei ist, das man behalten will.

Danach kommt der Schritt, der den Unterschied macht: **Upscale**. Higgsfield nutzt dafür Topaz-Labs-Plugins. Einstellungen 4K, 60 FPS, Slow Motion mal 1, etwa 28 Credits pro Video. Aus 720p mit 30 Bildern pro Sekunde wird damit ein deutlich flüssigeres Ergebnis.

Meine Reihenfolge ist deshalb: in 720p schneiden (Premiere), exportieren, dann hochskalieren, dann den Track darunterlegen. Nicht umgekehrt.

Für aufwendigere Clips gibt es die Cinema-Studio-Sektion: drei Referenzbilder, ein Prompt von Claude für weiche Übergänge, Ausgabe in 1080p und 9:16. Dabei ist mir ein Fehler unterlaufen, den man im fertigen Video sieht — ich habe Start- und Endframe vertauscht und das Ergebnis danach umgekehrt. Deswegen wirkt ein Teil der Bewegung etwas seltsam.

Nützlich ist außerdem das Canvas: ein Sammelort pro Projekt. Bild von Pinterest herunterladen, an Claude geben, den Prompt daraus extrahieren lassen, Prompt neben das Bild auf das Canvas legen. Damit wächst ein eigener Fundus an Prompts, die schon einmal etwas Brauchbares erzeugt haben.

## Phase 6 · Werbung

Veröffentlicht wird auf SoundCloud und TikTok. Beworben wird auf TikTok, mit sehr kleinen Beträgen.

Die Einstellungen, die ich fahre:

- Ziel: mehr Videoaufrufe
- Zielgruppe: Serbien, Kroatien, Bosnien, 18 bis 34 Jahre
- Budget: etwa 15 Euro am Tag über sieben Tage

Deutschland ist für diese Inhalte nicht die richtige Zielgruppe, weil der Text serbisch ist. Für rund 10 Euro kommen ungefähr 10.000 bis 15.000 Aufrufe zusammen. Bei einem Video wurden es rund 30.000 für denselben Betrag, weil es viral ging — das ist der Ausreißer, nicht der Normalfall.

Ein Detail, das ich unterschätzt hatte: Das Video war offensichtlich KI-generiert und ich hatte es nicht entsprechend markiert. Die Reichweite wurde daraufhin eingeschränkt. Erst durch die Anzeigen kam sie zurück.

## Was noch fehlt

Die Veröffentlichung auf Spotify und YouTube Music scheitert derzeit daran, dass die Musik KI-generiert ist. Das ist ein offener Punkt, kein gelöster.

Mein Weg dorthin, an dem ich gerade arbeite: Stems aus Suno herausziehen, Melodien und Vocals dort erzeugen, den Rest in einer Digital Audio Workstation produzieren. Die Texte schreibe ich ohnehin selbst, ohne KI, und zwischen erster Generierung und Endfassung liegen viele Iterationen. Der menschliche Anteil ist da — er muss nur so vorliegen, dass die Vertriebswege ihn akzeptieren.

## Fazit

Sobald die Pipeline steht, ist jede Veröffentlichung dieselben sechs Schritte: Text, Song, Cover, Upload, Video, Bewerbung. Die Werkzeuge können sich ändern, die Reihenfolge bleibt. Man baut die Struktur einmal und liefert danach fertige, beworbene Tracks am Fließband.

Ein Studio, ein Label oder ein Filmteam braucht es dafür nicht mehr. Was es braucht, ist ein Ablauf — und die Geduld, zu iterieren. Das Cover für Okean ist nach vier gescheiterten Anläufen entstanden.

## Kapitel der Aufnahme

- [2:24 — Die sechs Phasen und die Textstruktur](https://youtu.be/C0Ea6XYvoyw?t=144)
- [3:56 — Suno: die zwei Wege](https://youtu.be/C0Ea6XYvoyw?t=236)
- [8:00 — Phase 3: das Cover](https://youtu.be/C0Ea6XYvoyw?t=480)
- [11:59 — Wo die Bildgenerierung scheiterte](https://youtu.be/C0Ea6XYvoyw?t=719)
- [13:33 — Phase 4: Beschreibung, Tags, Upload](https://youtu.be/C0Ea6XYvoyw?t=813)
- [16:48 — Phase 5: das Video und der Upscale](https://youtu.be/C0Ea6XYvoyw?t=1008)
- [21:38 — Phase 6: Verbreitung und Anzeigen](https://youtu.be/C0Ea6XYvoyw?t=1298)

## Häufige Fragen

### Warum zuerst das Instrumental und erst danach der Gesang?

Weil der schnelle Weg — Text plus Style-Prompt, ganzer Song — der Weg mit der geringsten Kontrolle ist. Ich erzeuge zuerst nur das Instrumental, mit Weirdness 35 und Style Influence 75, generiere weiter, bis der Beat sitzt, und lasse Suno den Song erst danach über die Cover-Funktion neu singen. Zwischen erster Generierung und Endfassung liegen zweistellig viele Versionen.

### Warum ist die Bildgenerierung für das Cover gescheitert?

Weil ich ein gefundenes Bild nachbauen wollte. Vier Anläufe über zwei Modelle blieben am Referenzbild kleben, mit falscher Perspektive und falschem Outfit. Funktioniert hat der andere Weg: den Songtext an Claude geben und daraus einen Prompt zur Stimmung des Stücks schreiben lassen. Ein Bild zu erzeugen, das zu einem Text passt, ist deutlich leichter, als eines zu rekonstruieren, das man woanders gesehen hat.

### Was passiert, wenn man ein KI-generiertes Video auf TikTok nicht kennzeichnet?

Die Reichweite wird eingeschränkt. Das Video war offensichtlich KI-generiert, ich hatte es nicht entsprechend markiert, und die organische Verbreitung brach ein — zurück kam sie erst über die bezahlten Anzeigen. Das ist ein Detail, das ich unterschätzt hatte, und es kostet mehr, als das Kennzeichnen gekostet hätte.

---

Ein KI-Musikprojekt in sechs Phasen: Suno, Claude und Higgsfield — https://damjan-savic.com/de/wissen/ai-music-artist-suno-claude
KI-generierter Inhalt: https://damjan-savic.com/de/ki-transparenz
© 2026 Damjan Savić. https://damjan-savic.com
