Best Practices

Meistern Sie das Prompting für Music in ElevenCreative, um maximale Musikalität und Kontrolle zu erreichen.

Dieser Leitfaden fasst die effektivsten Techniken für Prompts für Music in ElevenCreative zusammen. Er behandelt, wie das Modell einen Prompt liest, Produktionsvokabular, musikalische Steuerung, Arrangement, Gesang, Loops, Sounddesign sowie strukturelles Timing und Liedtexte.

Das Modell versteht Absichten und erzeugt vollständiges, kontextbezogenes Audio auf Basis Ihrer Ziele. Allgemeine Prompts wie “Werbung für eine Sneaker-Marke” oder “friedliche Meditation mit Voiceover” reichen oft aus, um das Modell zu Ton, Struktur und Inhalten zu führen, die zu Ihrem Anwendungsfall passen.

Wie das Modell einen Prompt liest

Ein Prompt beantwortet fünf Fragen, ob beabsichtigt oder nicht: Genre, Stimmung, Instrumentierung, Tempo und Produktionsära. Jede offene Frage beantwortet das Modell mit der statistisch wahrscheinlichsten Wahl – also mit der durchschnittlichsten.

Ein Prompt, der alle fünf offenlässt:

upbeat electronic track

Dieselbe Anfrage mit Antworten auf alle fünf Fragen:

French house, 122 BPM, filtered disco sample chops, sidechained bass, tight
four-on-the-floor kick, rooftop-at-sunset mood, warm analog glue

Der zweite Prompt enthält keine besondere Technik – jede Entscheidung im Output wurde von einer Person getroffen. Entscheiden Sie Genre, Stimmung, Instrumente, Tempo und Ära, bevor das Modell für Sie entscheidet.

Genre und Kreativität

Das Modell folgt Genre-Konventionen und emotionalen Tönen zuverlässig. Es reagiert effektiv auf beides:

  • Abstrakte Stimmungsbeschreibungen (z. B. „unheimlich“, „bedrohlich“)
  • Detaillierte Musiksprache (z. B. „dissonante Violinenkreischer über einem pulsierenden Sub-Bass“)

Prompt-Länge und Detailgrad führen nicht immer zu besseren Ergebnissen. Für kreativere und unerwartetere Resultate können Sie einfache, stimmungsvolle Keywords verwenden, damit das Modell frei interpretiert und komponiert.

Produktionsvokabular

Das Modell versteht Musik so, wie in Studios darüber gesprochen wird. Studiosprache bewegt echte Regler: sidechained, close-mic’d, bone-dry, tape saturation, plate reverb verändern jeweils hörbar den Mix.

Dieselbe Ballade in drei Räumen – nur die Produktionsbegriffe ändern sich:

slow soul ballad, 68 BPM, female vocal — bone-dry drums, close-mic'd vocal, dead room
slow soul ballad, 68 BPM, female vocal — cavernous plate reverb, tape echo throws, gospel room
slow soul ballad, 68 BPM, female vocal — tape saturation, wow and flutter, dusty vinyl crackle

Wenn Ihnen das Vokabular fehlt, beschreiben Sie den Raum: „klingt, als wäre es in einem Treppenhaus aufgenommen worden“ liefert Ihnen ein Treppenhaus.

Die Produktionsära ist ein Regler wie das Tempo, und das Modell kann ihn mitten im Song drehen. Eine Ära zu benennen („1950er Rock ’n’ Roll mit Slapback-Echo“, „1990er Jungle“) bestimmt den gesamten Produktionscharakter. Wenn Sie Änderungen der Ära im Zeitverlauf beschreiben, entstehen kohärente Übergänge innerhalb eines Tracks.

Musikalische Steuerung

Das Modell folgt BPM zuverlässig und trifft häufig die gewünschte Tonart. Für mehr Kontrolle über Timing und Harmonie geben Sie in Ihrem Prompt Tempoangaben wie „130 BPM“ und Tonarten wie „in A-Moll“ an. Das Modell hält eine angegebene BPM und Tonart präzise genug ein, um den Output mit anderem Material zu kombinieren – einer Gesangsaufnahme, einem Sample oder einer zweiten Generierung.

Um Gesangsdarbietung und Klangfarbe zu beeinflussen, verwenden Sie ausdrucksstarke Beschreibungen wie „roh“, „live“, „glitchig“, „luftig“ oder „aggressiv“. Hinweise zur Darbietung funktionieren genauso: geflüstert, kraftvoll gesungen, gesprächig, ausdruckslos, gestapelte Harmonien. Derselbe Liedtext mit gegensätzlichen Anweisungen:

whispered indie folk, close and intimate, fingerpicked acoustic guitar
stadium rock, belted powerhouse vocal, huge drums, wall of guitars

Das Modell kann mehrere Sänger:innen effektiv umsetzen – verwenden Sie Prompts wie „zwei Sänger harmonisieren in C“, um das Gesangsarrangement zu steuern.

Im Allgemeinen führen detailliertere Prompts zu mehr Kontrolle und Ausdrucksstärke im Output.

Arrangement

Das Modell folgt zeitlichen Anweisungen. Beschreiben Sie das Arrangement der Reihe nach, wie Sie es einer Band erklären würden:

UK garage, 132 BPM — start with just a shuffled drum loop, add a warm sub bassline
after four bars, then bring in chopped vocal stabs for the drop

Die tragenden Wörter sind klein: beginne mit, nur, dann, füge hinzu. Ohne nur füllt das Modell die Stille – markieren Sie Stille explizit.

Loops

Ein Loop-Prompt ist eine Übung im Ausschließen. Geben Sie die Takte, die BPM und die Tonart an – und auch, was verboten ist:

boom bap drum break, 90 BPM, dusty and swung, four bars, no melody — just drums
dreamy guitar loop, 140 BPM, F sharp minor, emo trap, four bars, instrumental

„Keine Melodie, nur Drums“ ist der ganze Grund, warum der Drum-Break ein Drum-Break bleibt. Bei Loops ist der negative Raum der Prompt.

Strukturelles Timing und Liedtexte

Sie können die Länge des Songs angeben (z. B. „60 Sekunden“) oder den automatischen Modus verwenden, damit das Modell die Dauer bestimmt. Wenn keine Liedtexte bereitgestellt werden, generiert das Modell strukturierte Liedtexte, die zur gewählten oder automatisch erkannten Länge passen.

Standardmäßig enthalten die meisten Musik-Prompts Liedtexte. Um Musik ohne Gesang zu generieren, fügen Sie Ihrem Prompt „nur instrumental“ hinzu. Sie können auch eigene Liedtexte schreiben, um mehr kreative Kontrolle zu erhalten. Das Modell verwendet Ihre Liedtexte zusammen mit der Prompt-Länge, um Gesangsstruktur und Platzierung zu bestimmen.

Um festzulegen, wann der Gesang beginnt oder endet, fügen Sie klare Zeitangaben hinzu, etwa:

  • „Liedtext beginnt bei 15 Sekunden“
  • „nur instrumental nach 1:45“

Das Modell unterstützt die Generierung mehrsprachiger Liedtexte. Um die Sprache eines generierten Songs in unserer UI zu ändern, verwenden Sie Folgeanweisungen wie „mach es auf Japanisch“ oder „ins Spanische übersetzen“.

Instrumenten- und Gesangsisolierung

Um Stems mit mehr Kontrolle zu erstellen, verwenden Sie gezielte Prompts und Struktur:

  • Verwenden Sie das Wort „Solo“ vor Instrumenten (z. B. „Solo-E-Gitarre“, „Solo-Klavier in C-Moll“).
  • Verwenden Sie für Gesang „a cappella“ vor der Gesangsbeschreibung (z. B. „a-cappella-Frauenstimmen“, „a-cappella-Männerchor“).

So verbessern Sie Stem-Qualität und Kontrolle:

  • Geben Sie Tonart, Tempo (BPM) und musikalischen Ton an (z. B. „a-cappella-Gesang in A-Dur, 90 BPM, soulvoll und roh“).
  • Beschreiben Sie die Musik so detailliert wie möglich, um den Output des Modells zu steuern.

Sounddesign

Das Modell erzeugt Klang selbst und hat keine Meinung dazu, ob der von Ihnen beschriebene Klang physikalisch möglich wäre. Nichtmusikalisches Audio – Soundeffekte, Atmosphäre, Texturen – kann direkt per Prompt erzeugt oder in einen Track integriert werden:

a thunderstorm in 6/8 — thunder lands on the downbeat, rain fills the offbeats,
distant lightning as crash cymbals
one enormous cathedral bell that, as it decays, slowly turns out to have been
a choir all along
an orchestra tuning up that accidentally becomes techno — the A gets a kick drum,
chaos becomes a groove

Die Methode: Nehmen Sie einen Klang, der existiert, geben Sie ihm eine Eigenschaft, die er unmöglich haben kann, und beschreiben Sie das Ergebnis ohne Umschweife. Jede Technik in diesem Leitfaden – Tonarten, BPM, Sidechaining, beschriebenes Arrangement – funktioniert mit diesen Klängen als Rohmaterial.

Audio-Referenz

Manche Ideen lassen sich kaum beschreiben – eine Melodie, die Sie in Ihr Smartphone gesummt haben, der Swing einer bestimmten Bassline, eine Textur, auf die Sie nur zeigen können. Laden Sie einen Track (auch eine Sprachnotiz) als Audio-Referenz hoch, und das Modell übernimmt dessen Gefühl, Groove und Klangpalette, ohne die Noten zu kopieren.

Der Prompt steuert weiterhin alles, was die Referenz offenlässt. Eine gut funktionierende Kombination: eine Referenz, die das Gefühl vermittelt, und ein Prompt, der beschreibt, was anders sein soll – „gleiche Energie, Half-Time-Drums, weiblicher Gesang“.

Uploads können etwa 30 Sekunden lang sein. Jeder Referenztrack durchläuft vor der Generierung eine Urheberrechtsprüfung – Audio-Referenz ist für Musik konzipiert, die Sie selbst erstellt haben.

Beispiel-Prompts

Für maximale Kreativität können Sie mit dem Modell über Songbeschreibungen hinausgehen und Ihre Absicht formulieren.

Track for a high-end mascara commercial. Upbeat and polished. Voiceover only.
The script begins: "We bring you the most volumizing mascara yet." Mention the brand
name "X" at the end.

Zusammenfassung

Drei Gewohnheiten decken den Großteil dieses Leitfadens ab:

  1. Seien Sie spezifisch. Genre, Stimmung, Instrumente, Tempo, Ära – entscheiden Sie alle fünf, sonst entscheidet das Modell für Sie.
  2. Sprechen Sie Produktion. Studiovokabular bewegt echte Regler, und das Modell hält Zahlen exakt ein.
  3. Beschränken Sie, was wichtig ist, und lassen Sie überall sonst Raum. Beschriebene Arrangements, explizite Ausschlüsse, Anweisungen für die Stimme.

Fortgeschritten: Kompositionspläne

Für präzise Kontrolle über Abschnittsstruktur, Platzierung von Liedtexten und Arrangements mit mehreren Sänger:innen verwenden Sie Kompositionspläne statt einfacher Text-Prompts.