# Prompts für KI-Videogeneratoren schreiben

Ein praktischer Leitfaden für Seedance, Kling, Veo, Runway, Hailuo, H3 Max und Wan, mit Beispielen und fertigen Anweisungen für ChatGPT.

Stell dir eine einfache Werbeaufnahme vor: Eine Kaffeepackung steht auf der Arbeitsplatte, daneben dampft eine Tasse, und die Kamera nähert sich langsam dem Produkt. Bevor du diese Szene einem Generator beschreibst, kläre die Ausgangslage. Hast du bereits ein Foto, das du animieren möchtest? Soll das Modell die Küche anhand eines Textes erstellen? Soll es die Verpackung nach einem separaten Foto nachbilden? Braucht das Video Ton?

Diese Entscheidungen bestimmen den Inhalt des Prompts, also der Anweisung an den Generator. Auch das gewählte Modell spielt eine Rolle. Die Dokumentation von Runway Gen-4 empfiehlt, das gewünschte Ergebnis zu beschreiben, statt Verbote anzuhängen. Veo hat ein dokumentiertes Feld für negative Anweisungen, während MiniMax spezielle Kamerabefehle für Hailuo beschreibt. Deshalb ist es wenig sinnvoll, dieselbe ausführliche Vorlage in jedes Werkzeug zu kopieren. [Quellen: Runway — Gen-4-Leitfaden](https://help.runwayml.com/hc/en-us/articles/39789879462419-Gen-4-Video-Prompting-Guide), [Google — Veo-Leitfaden](https://cloud.google.com/vertex-ai/generative-ai/docs/video/video-gen-prompt-guide), [MiniMax — image-to-video](https://platform.minimax.io/docs/api-reference/video-generation-i2v).

Der Leitfaden umfasst 19 Kapitel zu einzelnen Modellen und ihren Varianten. Die Beispiele zeigen mögliche Schreibweisen und sind keine Ergebnisse eines Vergleichstests. Eine Anweisung kann das gewünschte Ergebnis präzise beschreiben, garantiert aber keine fehlerfreie Umsetzung durch den Generator.

## Bevor du die Anleitung für dein Modell auswählst

### In welcher Sprache solltest du schreiben?

Die Beispiel-Prompts in diesem Leitfaden sind auf Englisch. So lassen sich Begriffe aus der Dokumentation und der Kameraführung verwenden. Das bedeutet jedoch nicht, dass Englisch immer bessere Ergebnisse liefert als Polnisch oder andere Sprachen.

Die Google-Dokumentation gibt an, dass Veo Englisch vollständig unterstützt. Bei den anderen Modellfamilien ist Englisch die hier gewählte Arbeitssprache, keine durch Studien belegte beste Wahl. [Quelle: Google — Videogenerierung in der Gemini API](https://ai.google.dev/gemini-api/docs/veo).

Unterscheide drei Dinge:

| Element | Beschreibung |
| --- | --- |
| Anweisung an den Generator | Szene, Handlung und Kameraführung kannst du auf Englisch beschreiben. |
| Gesprochener Text einer Figur | Gib den genauen Wortlaut und die Sprache an. Prüfe, ob das Modell Sprache in dieser Sprache erzeugen kann. |
| Sichtbarer Text im Video | Behalte den ursprünglichen Wortlaut bei. Wichtige Werbeaussagen oder Preise planst du am besten als separate Ebene für den Schnitt. |

Prompt-Sprache und gesprochene Sprache sind nicht dasselbe. Die Anleitungen zu Kling 2.6 und 3.0 beschreiben die automatische Übersetzung von Dialogen aus nicht unterstützten Sprachen ins Englische. Ein polnischer Satz im Prompt garantiert daher noch keinen polnischen Dialog. [Quellen: Kling 2.6 — audio](https://kling.ai/quickstart/klingai-video-26-audio-user-guide), [Kling 3.0 — Modellanleitung](https://kling.ai/quickstart/klingai-video-3-model-user-guide).

### Lege zuerst die Rolle des Materials fest

**Text-to-Video: Video aus Text.** Das Modell erstellt sowohl das Aussehen der Szene als auch ihren Ablauf. Beschreibe deshalb Ort, Hauptmotiv, Handlung, Licht und Kameraführung.

**Image-to-Video: Animation eines Startbilds.** Das Foto bildet das erste Bild des Videos, den *Start Frame*. Es bestimmt die Anfangskomposition. Konzentriere dich im Prompt vor allem auf die Bewegung und auf das, was unverändert bleiben soll.

**Generierung mit Referenzmaterial.** Ein Foto oder Video dient als Vorlage für Produkt, Figur, Stil oder Bewegung. Es muss nicht das erste Bild sein. Beschreibe, welche Merkmale das Modell daraus übernehmen soll.

**Bearbeitung eines bestehenden Videos.** Ausgangspunkt ist eine fertige Aufnahme. Nenne das zu ändernde Element, das gewünschte Ergebnis und alles, was erhalten bleiben soll.

Nicht jede Plattform bietet alle Modi einer Modellfamilie an. Modellname und Plattformname sind deshalb zwei getrennte Angaben. [Quellen: Runway — image-to-video](https://help.runwayml.com/hc/en-us/articles/48324313115155), [Kling — Omni](https://kling.ai/quickstart/klingai-video-3-omni-model-user-guide).

### So nutzt du die fertigen Anweisungen für ChatGPT

Die Blöcke mit der Überschrift **„Start-Prompt für ChatGPT“** bereiten das Gespräch mit dem Chatbot vor. Füge sie nicht direkt in den Videogenerator ein.

Wähle zuerst die Anleitung für dein Modell und sende sie an ChatGPT. Der Chat soll die genannten Quellen prüfen, die wichtigsten Regeln zusammenfassen und fehlende Angaben erfragen. Beschreibe danach die Einstellung und füge ein Foto oder anderes Material hinzu. Du erhältst einen englischen Prompt für den Generator und separat die Einstellungen, etwa Dauer, Seitenverhältnis und Ton.

Wenn du die Einstellung und alle nötigen Angaben gleich mitlieferst, muss nicht auf eine weitere Nachricht gewartet werden. Im weiteren Verlauf sollte sich der Chat außerdem Modell und Plattform merken, statt bei jedem Foto erneut danach zu fragen.

Die Anweisungen setzen Zugriff auf die Websuche voraus. Kann der Chat die Dokumentation nicht lesen, soll er klar zwischen überprüften Angaben und noch zu bestätigenden Informationen unterscheiden. [Quelle: OpenAI — ChatGPT Search](https://help.openai.com/en/articles/9237897-chatgpt-search).

**Die Anweisungen dienen ausschließlich der Textvorbereitung. Sie fordern nicht zur Generierung von Bildern oder Videos auf.**

---

## 1. Seedance 2.5

### So baust du den Prompt auf

Ein Prompt für Seedance 2.5 lässt sich wie eine kurze Drehanweisung behandeln. Lege das Ergebnis fest, ordne dem beigefügten Material Aufgaben zu und beschreibe dann Handlung und Kamera. Der Leitfaden behandelt außerdem Referenzen, Zeitabschnitte, Ton und die Bearbeitung vorhandener Videos. [Quelle: fal — Seedance-2.5-Leitfaden](https://fal.ai/learn/devs/how-to-use-seedance-2-5).

Eine hilfreiche Reihenfolge ist:

> Art der Einstellung → Rolle des Materials → Handlungsablauf → Kamerabewegung → Ton → zu erhaltende Elemente.

Das ist eine Möglichkeit, Informationen zu ordnen, keine vorgeschriebene Syntax. Reichen drei konkrete Sätze für die Fotoanimation, muss daraus kein vollständiges Drehbuch werden.

#### Gib jeder Referenz eine klare Aufgabe

Zeigen zwei Fotos dieselbe Verpackung von verschiedenen Seiten, schreibe das ausdrücklich. Bei einem zusätzlichen Innenraumfoto gib an, ob es die gesamte Umgebung oder nur die Lichtrichtung vorgeben soll.

```text
The first two reference images show the same coffee package from
different angles. Use them as references for the package's shape,
colors, and label design.

Use the third reference image for the kitchen setting and the
direction of the window light.
```

Der Leitfaden zur fal-Integration verwendet Markierungen wie `@Image1`. Nutze sie nur, wenn die gewählte Oberfläche sie unterstützt. Ein Dateiname oder Marker im Text ersetzt nicht das Hinzufügen des Materials zum richtigen Eingabefeld. [Quelle: fal — Prompts für Seedance 2.5](https://fal.ai/learn/devs/seedance-2-5-prompting-guide).

#### Beschreibe Handlungen in logischer Reihenfolge

Ein vages „Frau hebt eine Tasse, dynamische Werbung“ überlässt dem Modell viele Entscheidungen. Soll die Handlung genau ablaufen, beschreibe sie präziser:

> Eine rechte Hand kommt vom rechten Bildrand, greift die Tasse am Henkel und hebt sie über die Arbeitsplatte. Nach einem kurzen Moment stellt sie die Tasse an dieselbe Stelle zurück, lässt den Henkel los und verlässt das Bild.

Jede Handlung sollte aus der vorherigen folgen. Die Tasse kann nicht gleichzeitig auf der Arbeitsplatte stehen und in der Hand sein. Soll sie zur Ausgangsposition zurückkehren, müssen das Abstellen und Loslassen beschrieben werden.

#### Nutze Zeitangaben, wenn die Reihenfolge wichtig ist

Das folgende Beispiel setzt ein Startbild mit Verpackung und Tasse voraus, deren Henkel von rechts erreichbar ist. Außerdem wird ein Modus benötigt, der einen 12-Sekunden-Clip erzeugen kann.

```text
One continuous shot based on the starting image. The coffee package
remains stationary throughout.

0–3 seconds: a right hand enters from the right edge of the frame
and gently grasps the cup by its handle.

3–8 seconds: the hand lifts the cup a few centimeters above the table
and holds it steady. The camera slowly moves forward toward the
package, keeping the front label fully in view.

8–12 seconds: the hand lowers the cup to its original position,
releases the handle, and leaves the frame. The camera gradually
slows to a stop, holding a close view of the package.

Audio: quiet room ambience and a soft tap as the cup is
set back on the table.
```

Zeitmarken beschreiben den gewünschten Ablauf. Sie garantieren keine bildgenaue Ausführung jeder Handlung. Passe die Anzahl der Aktionen an die Videolänge an. [Quelle: fal — Seedance-2.5-Leitfaden](https://fal.ai/learn/devs/how-to-use-seedance-2-5).

### Sprache, Ton und Einschränkungen

Die Generatoranweisungen in diesem Leitfaden sind auf Englisch. Dialoge schreibst du jedoch in der Sprache, in der sie gesprochen werden sollen, und ordnest sie einer bestimmten Figur zu. Prüfe die Unterstützung dieser Sprache gesondert.

Die Dokumentation beschreibt außerdem optionale Zeichen für Ton und Untertitel: runde Klammern für Musik, spitze für Effekte, geschweifte für Dialoge und `〖〗` für Untertitel. Sie sind nicht in jedem Prompt nötig. Eine einfache Beschreibung, die einen Ton mit einer sichtbaren Handlung verknüpft, ist ein guter Ausgangspunkt. [Quelle: fal — Seedance-2.5-Leitfaden](https://fal.ai/learn/devs/how-to-use-seedance-2-5).

„Das Etikettenlayout erhalten“ ist nicht dasselbe wie ein eigenes Feld `negative_prompt`. Ob dieses Feld verfügbar ist, hängt von der Integration ab. Wähle bei der Videobearbeitung eine Basisaufnahme und beschreibe den Änderungsumfang, statt mehreren Dateien gleichzeitig die Hauptrolle zuzuweisen. [Quelle: Dreamina — Seedance-2.5-Leitfaden](https://dreamina.capcut.com/seedance/seedance-2-5-prompt).

#### Start-Prompt für ChatGPT — Seedance 2.5

```text
Hilf mir, Prompts für Seedance 2.5 vorzubereiten. Antworte auf Deutsch und schreibe die fertigen Generator-Prompts auf Englisch. Starte keine Bild- oder Videogenerierung.

Lies zunächst die verfügbare Dokumentation:
https://fal.ai/learn/devs/how-to-use-seedance-2-5
https://fal.ai/learn/devs/seedance-2-5-prompting-guide
https://dreamina.capcut.com/seedance/seedance-2-5-prompt

Fasse die für Prompts wichtigen Regeln kurz zusammen. Kannst du eine Quelle nicht lesen, sage, was sich nicht bestätigen ließ. Sobald ich die Plattform nenne, prüfe auch die Funktionen ihrer konkreten Integration.

Falls ich die Einstellung noch nicht beschrieben habe, frage nach Beschreibung, Plattform, Dauer, Seitenverhältnis und Material. Frage nur nach fehlenden Angaben. Liegen Beschreibung und Anhänge bereits vor, beginne mit der Arbeit. Erfinde keine Beispielszene, bevor ich meine Idee vorstelle.

Erkenne, ob es um Text-to-Video, die Animation eines Startbilds, Referenzen oder Videobearbeitung geht. Weise jeder beigefügten Datei eine konkrete Rolle zu. Nutze von der Plattform unterstützte Markierungen.

Bewahre meine Idee. Beschreibe die Handlungen in logischer Reihenfolge, trenne Kamera- und Objektbewegung und lege das Ende der Einstellung fest. Konzentriere dich bei Fotoanimationen auf Veränderungen, ohne den gesamten Bildinhalt zu wiederholen. Nutze Zeitabschnitte nur bei Bedarf.

Behalte die von mir vorgegebene Dialogsprache bei. Wird sie nicht unterstützt, erkläre die Einschränkung, statt den Text selbst zu übersetzen. Ordne Geräusche konkreten Ereignissen zu.

Gib einen fertigen Prompt in einem Codeblock aus. Nenne darunter auf Deutsch die auf der Plattform verfügbaren Einstellungen. Erstelle einen separaten negativen Prompt nur, wenn der gewählte Modus ihn unterstützt. Erwähne nur Einschränkungen, die für diese Einstellung relevant sind.

Verwende für weitere Einstellungen die bisherigen Werte, solange ich sie nicht ändere. Frage bekannte Angaben nicht erneut ab.
```

---

## 2. Seedance 2.0 und die Bezeichnung „Seedance 2 Pro“

### Kläre zuerst, welches Modell du auswählst

Der auf einer Plattform angezeigte Name reicht nicht immer aus, um die Modellversion zu erkennen. Magnific führt Seedance 2.0, Seedance 2.0 Fast und Seedance 2.0 Mini auf. Die hier genannten Quellen beschreiben keine eigenen Prompt-Regeln für „Seedance 2 Pro“. Es gibt daher keine Grundlage, dieser Bezeichnung eine eigene Syntax zuzuschreiben. Ordne den Namen zuerst einer konkreten Variante des Dienstes zu. [Quelle: Magnific — Seedance 2](https://www.magnific.com/seedance-2).

### Prompts für Seedance 2.0 schreiben

Die Runway-Dokumentation beschreibt die Generierung aus Text, die Arbeit mit Referenzen sowie die Nutzung des ersten und letzten Bilds. Der Prompt sollte zum gewählten Modus passen. [Quelle: Runway — Seedance 2.0](https://help.runwayml.com/hc/en-us/articles/50488490233363-Creating-with-Seedance-2-0).

Beschreibe bei **Text-to-Video** zuerst das Aussehen der Szene und danach die Bewegung:

```text
A simple product commercial in a bright kitchen. A matte coffee
package stands on a pale wooden table, with a white ceramic cup
slightly behind it.

The camera tracks slowly to the right, parallel to the edge of the
table. The package remains fully in frame, with its front label
visible. The camera movement creates gentle parallax between the
package and the kitchen background.

Steam rises slowly from the cup. Soft daylight enters from the left.
The package remains upright and stationary throughout the shot.
```

Bei **Image-to-Video** bestimmt das Foto bereits das Aussehen der Anfangsszene. Du kannst die Beschreibung also kürzen:

```text
The camera tracks slowly to the right, parallel to the table edge.
The coffee package remains upright and stationary, with its front
label visible throughout. Steam rises gently from the cup.
The lighting remains consistent with the starting image.
```

Gib bei **Referenzen** an, was aus jeder Datei übernommen werden soll. Ein Video kann nur die Kamerabewegung vorgeben, nicht die Ausstattung. Ein Produktfoto kann das Aussehen bestimmen, ohne die Position im neuen Bild festzulegen.

Beschreibe bei **erstem und letztem Bild** einen logischen Übergang zwischen den gelieferten Bildern. Zeigt das letzte Bild einen weiteren Ausschnitt als das erste, kann eine kontinuierliche Fahrt auf das Produkt zu dazu im Widerspruch stehen. [Quelle: Runway — Seedance 2.0](https://help.runwayml.com/hc/en-us/articles/50488490233363-Creating-with-Seedance-2-0).

### Sprache und negative Anweisungen

Englisch bleibt hier die Arbeitssprache. Übertrage die speziellen Audiomarkierungen von Seedance 2.5 aber nicht automatisch auf Version 2.0. Beginne mit einer einfachen Beschreibung und prüfe die Dokumentation der gewählten Integration.

Gehe bei negativen Anweisungen genauso vor. Beschreibe zuerst das gewünschte Ergebnis. Einen separaten *negativen Prompt* mit unerwünschten Elementen erstellst du nur, wenn die Plattform dafür ein Feld anbietet.

#### Start-Prompt für ChatGPT — Seedance 2.0

```text
Hilf mir, Prompts für Seedance 2.0 zu schreiben. Erkläre auf Deutsch und schreibe fertige Prompts auf Englisch. Starte keine Videogenerierung.

Prüfe zuerst die verfügbare Dokumentation:
https://seed.bytedance.com/en/seedance2_0
https://help.runwayml.com/hc/en-us/articles/50488490233363-Creating-with-Seedance-2-0
https://fal.ai/seedance-2.0

Fasse die wichtigsten Regeln zusammen. Trenne Modellfunktionen von Plattformmöglichkeiten. Schreibe Version 2.0 keine Funktionen von Seedance 2.5 ohne Bestätigung zu. Kannst du eine Quelle nicht lesen, benenne den Umfang der Unsicherheit.

Falls die Einstellungsbeschreibung fehlt, frage nach ihr sowie nach Plattform, Dauer, Seitenverhältnis und Material. Frage nur nach fehlenden Angaben. Prüfe die Plattformdokumentation, sobald du ihren Namen kennst.

Erstelle anhand meiner Beschreibung einen stimmigen Prompt. Beschreibe bei Text-to-Video Aussehen und Ablauf der Szene, bei Fotoanimationen vor allem die Bewegung. Gib Referenzen konkrete Aufgaben. Beschreibe bei Start- und Endbild einen Übergang, der zu beiden Bildern passt.

Schreibe natürliche Sätze. Unterscheide Kamera- und Objektbewegung. Ergänze keine unbestellten Figuren, Schnitte oder Effekte. Bewahre Markennamen, sichtbare Texte und Dialogsprache. Wird die gesprochene Sprache nicht unterstützt, erkläre das, statt den Dialog selbst zu übersetzen.

Gib den Prompt in einem Codeblock und die Einstellungen separat auf Deutsch aus. Füge einen negativen Prompt nur für einen unterstützten Modus hinzu. Behalte die vereinbarten Einstellungen für weitere Aufnahmen bei, bis ich sie ändere.
```

#### Start-Prompt für ChatGPT — auf der Plattform als „Seedance 2 Pro“ bezeichnetes Modell

```text
Auf meiner Plattform heißt das Modell „Seedance 2 Pro“. Hilf mir herauszufinden, welche Version dahintersteckt, und anschließend Prompts dafür vorzubereiten. Generiere keine Bilder oder Videos.

Falls ich die Plattform nicht genannt habe, frage nach ihrem Namen oder einem Screenshot der Einstellungen. Prüfe damit die Dokumentation der Integration. Du kannst mit diesen Quellen beginnen:
https://www.magnific.com/seedance/seedance-2
https://www.magnific.com/ai/docs/video-ai-models
https://seed.bytedance.com/en/seedance2_0

Behandle Pro, Standard, Fast und Mini nicht als austauschbare Namen. Bleibt die Identifikation unsicher, sage, was sich nicht klären ließ. Nutze dann nur bestätigte Regeln der Seedance-2.0-Familie und nenne keine ungeprüften Parameter.

Sobald das Modell feststeht, frage nach fehlenden Angaben zur Einstellung: Beschreibung, Dauer, Seitenverhältnis und Material. Habe ich sie schon geliefert, erstelle den Prompt ohne weitere Fragerunde.

Schreibe Erklärungen auf Deutsch und den Generator-Prompt auf Englisch. Passe ihn an Text-to-Video, Startbildanimation oder Referenzarbeit an. Beschreibe Handlung, Kamerabewegung und unveränderliche Elemente.

Bewahre Dialogsprache und sichtbare Texte. Prüfe deren Unterstützung für die konkrete Variante. Ergänze einen negativen Prompt nur, wenn ein passendes Feld existiert. Gib den fertigen Text im Codeblock und die Einstellungen darunter aus.

Nutze für weitere Einstellungen das vereinbarte Modell und die Plattform, bis ich eine Änderung verlange.
```

---

## 3. Seedance 2.0 Fast

### Die Fast-Variante testen

Die Dokumentation stellt Seedance 2.0 Fast als Variante derselben Familie mit eigenen Einstellungen vor. Daraus folgt nicht, dass eine andere Satzstellung oder spezielle Sprache nötig wäre. [Quelle: fal — Seedance 2.0](https://fal.ai/seedance-2.0).

Begrenze beim ersten Versuch die Anzahl der Variablen. Teste zuerst die Kamerabewegung, ergänze dann Bewegung in der Umgebung und zuletzt eine Interaktion mit einem Gegenstand. Verschlechtert eine bestimmte Änderung das Ergebnis, lässt sich die Ursache leichter erkennen. Das ist eine Testmethode, keine Aussage, dass Fast nur für einfache Szenen geeignet sei.

Beispiel für ein Produktfoto:

```text
One continuous shot based on the starting image. The camera slowly
moves forward toward the coffee package. The package stays fixed
on the table, with its front label visible throughout.

A small amount of steam rises from the cup behind it.
The soft window light remains constant.
```

Im nächsten Versuch kannst du eine Hand ergänzen, die die Tasse hebt. Ändere dabei nicht gleichzeitig Licht, Hintergrund und Kamerarichtung. Sonst lässt sich kaum beurteilen, welche Anpassung das Ergebnis beeinflusst hat.

### Sprache und Einstellungen

Die Beispiele sind auf Englisch. Dauer, Seitenverhältnis und Audiogenerierung stellst du separat ein, entsprechend den Möglichkeiten der Plattform.

Das unten verlinkte API-Schema enthält für den beschriebenen Fast-Modus kein eigenes Feld `negative_prompt`. Ergänze diesen Parameter nicht aufgrund einer Anleitung für einen anderen Generator. [Quelle: fal — Seedance 2.0 Fast, text-to-video](https://fal.ai/models/bytedance/seedance-2.0/fast/text-to-video/api).

#### Start-Prompt für ChatGPT — Seedance 2.0 Fast

```text
Hilf mir, Prompts für Seedance 2.0 Fast vorzubereiten. Antworte auf Deutsch und schreibe fertige Prompts auf Englisch. Generiere keine Videos.

Prüfe zuerst die verfügbare Dokumentation:
https://fal.ai/seedance-2.0
https://fal.ai/models/bytedance/seedance-2.0/fast/text-to-video/api
https://help.runwayml.com/hc/en-us/articles/50488490233363-Creating-with-Seedance-2-0

Stelle die wichtigsten Regeln kurz vor. Prüfe die Plattformfunktionen, sobald ich den Namen nenne. Gehe nicht davon aus, dass Fast dieselben Einstellungen wie andere Varianten hat. Sage ausdrücklich, wenn eine Quelle nicht zugänglich ist.

Fehlt die Einstellungsbeschreibung, frage nach Beschreibung, Plattform, Dauer, Seitenverhältnis und Material. Frage bekannte Informationen nicht erneut ab. Sind die Angaben ausreichend, erstelle sofort den Prompt.

Bewahre die Grundidee und beschreibe Ereignisse in logischer Reihenfolge. Trenne Kamera- und Objektbewegung. Konzentriere dich bei Fotoanimationen auf Veränderungen. Gib Referenzen konkrete Aufgaben. Ergänze nicht eigenständig weitere Handlungen oder Effekte.

Bewahre Markennamen, sichtbare Texte und Dialogsprache. Prüfe die Sprachunterstützung, falls die Einstellung sie benötigt. Erstelle einen negativen Prompt nur, wenn der Modus ihn unterstützt.

Gib einen Prompt im Codeblock aus. Nenne Dauer, Seitenverhältnis, Auflösung und Ton separat und nur im Rahmen der verfügbaren Plattformoptionen. Nutze für weitere Einstellungen die zuvor vereinbarte Konfiguration.
```

---

## 4. Seedance 2.0 Mini

### Beginne mit einer leicht beurteilbaren Einstellung

Seedance 2.0 Mini wird in den Katalogen von Runway und Magnific geführt. Die hier genannten Quellen enthalten jedoch keine ebenso ausführliche, eigene Prompt-Anleitung für diese Variante. Die folgenden Hinweise sind daher Vorschläge zum Testen, keine zusätzlichen Einschränkungen von Mini. [Quellen: Runway — Modellkatalog](https://docs.dev.runwayml.com/guides/models/), [Magnific — Seedance 2](https://www.magnific.com/seedance-2).

Beginne mit einer Aufgabe: Die Kamera fährt seitwärts, das Produkt bleibt stehen und das Licht unverändert. Das Öffnen der Verpackung, Dialoge und Änderungen der Kulisse testest du separat.

Verwende beim Vergleich von Mini mit dem vollständigen Seedance 2.0 dasselbe Bild und möglichst denselben Prompt. Sonst bewertest du gleichzeitig das Modell und Unterschiede in der Beschreibung.

```text
The camera tracks slowly to the right, parallel to the table edge.
The coffee package remains stationary and fully in frame.
The camera movement creates gentle parallax between the package
and the background.

The package's shape, label design, and soft daylight remain
consistent with the starting image.
```

Englisch ist hier die Arbeitssprache. Übertrage Regeln älterer Modelle mit „Lite“ im Namen nicht automatisch auf Mini. Prüfe Referenz-, Audio- und Endbild-Unterstützung für die konkrete Integration.

#### Start-Prompt für ChatGPT — Seedance 2.0 Mini

```text
Hilf mir, Prompts für Seedance 2.0 Mini zu schreiben. Erkläre auf Deutsch und schreibe fertige Prompts auf Englisch. Generiere keine Videos.

Prüfe zuerst die verfügbaren Informationen:
https://docs.dev.runwayml.com/guides/models/
https://www.magnific.com/seedance/seedance-2
https://help.runwayml.com/hc/en-us/articles/50488490233363-Creating-with-Seedance-2-0

Trenne gemeinsame Regeln von Seedance 2.0 von Mini-spezifischen Angaben. Übertrage keine Funktionen von Lite oder 2.5. Klärt die Dokumentation einen Punkt nicht, sage das ausdrücklich.

Falls ich die Einstellung nicht beschrieben habe, frage nach Beschreibung, Plattform, Dauer, Seitenverhältnis und Material. Frage nur nach fehlenden Angaben. Prüfe nach Nennung der Plattform die Funktionen dieser Integration.

Erstelle einen Prompt gemäß meiner Idee. Definiere Handlung, Richtung und Tempo der Kamerabewegung sowie unbewegliche Elemente klar. Wiederhole bei Fotoanimationen nicht die gesamte Bildbeschreibung. Beziehe dich nur auf tatsächlich beigefügtes Material.

Sind zu viele Handlungen für die Cliplänge vorgesehen, weise darauf hin und schlage eine Reduzierung vor. Bewahre sichtbare Texte und Dialogsprache; prüfe die Sprachunterstützung separat.

Gib den fertigen Prompt im Codeblock und die Einstellungen auf Deutsch aus. Nenne einen negativen Prompt und zusätzliche Parameter erst nach Bestätigung ihrer Verfügbarkeit. Behalte die vereinbarten Einstellungen für weitere Aufnahmen bei.
```

---

## 5. Kling 2.5 / Kling 2.5 Turbo

### Beschreibe Kamera- und Objektbewegung getrennt

In der hier beschriebenen fal-Integration enthält der vollständige Modellname „2.5 Turbo“. Zusätzliche Bezeichnungen kennzeichnen die Qualitätsvariante. Prüfe vor der Auswahl der Einstellungen den vollständigen Namen. [Quelle: fal — Kling 2.5 Turbo Standard](https://fal.ai/models/fal-ai/kling-video/v2.5-turbo/standard/image-to-video).

Klings Text-to-Video-Leitfaden empfiehlt die Beschreibung des Hauptmotivs oder der Figur, der Handlung und der Umgebung, ergänzt um Kamera und Licht. Bei Image-to-Video ist die Bewegung wichtiger, da das Foto das Aussehen der Elemente bereits festlegt. [Quelle: Kling — Text-to-Video-Leitfaden](https://kling.ai/quickstart/text-to-video-prompt-guide).

Zeigt das Foto eine Verpackung, eine Tasse und einen Vorhang, könntest du schreiben:

```text
The camera tracks slowly to the right, parallel to the table edge.
The coffee package remains upright and stationary, with its front
label visible throughout.

Steam rises gently from the cup behind the package. The curtain
in the background sways slightly in a light breeze.
```

Jeder Satz bezieht sich auf ein bestimmtes Element. Eine Korrektur erfordert deshalb nicht das Umschreiben des gesamten Prompts. Ist auf dem Foto kein Vorhang zu sehen, ergänze diesen Satz nicht nur, weil er im Beispiel steht.

Achte besonders auf den Unterschied zwischen „Die Verpackung dreht sich“ und „Die Kamera fährt im Bogen um die unbewegliche Verpackung“. Im ersten Fall bewegt sich das Produkt, im zweiten die Kamera. Soll das Etikett jederzeit sichtbar bleiben, beschreibe einen kleinen Bogen statt einer vollständigen Umrundung.

### Negative Anweisungen und Sprache

Die Beispiele sind auf Englisch. Ein separater *negativer Prompt* kann eine kurze Liste relevanter Fehler enthalten, sofern der gewählte Modus ein solches Feld unterstützt.

In der hier beschriebenen Kling-2.5-Turbo-Standard-API ist dieses Feld verfügbar. Beispiel:

```text
duplicate packages, distorted packaging, altered label design,
flickering lighting, sudden camera shake
```

Dasselbe Schema beschreibt den Parameter `cfg_scale`. Belasse ihn zunächst auf dem Standardwert. Willst du seinen Einfluss testen, ändere ihn bei gleichbleibendem Prompt und Eingangsmaterial. Der Höchstwert ist nicht automatisch die beste Einstellung. [Quelle: fal — Kling 2.5 Turbo Standard, API](https://fal.ai/models/fal-ai/kling-video/v2.5-turbo/standard/image-to-video/api).

#### Start-Prompt für ChatGPT — Kling 2.5 Turbo

```text
Hilf mir, Prompts für Kling 2.5 Turbo vorzubereiten. Antworte auf Deutsch und schreibe Generator-Prompts auf Englisch. Generiere keine Videos.

Prüfe zuerst die verfügbare Dokumentation:
https://kling.ai/quickstart/text-to-video-prompt-guide
https://kling.ai/quickstart/image-to-video-guide
https://fal.ai/models/fal-ai/kling-video/v2.5-turbo/standard/image-to-video/api

Fasse die Regeln kurz zusammen. Sobald ich die Plattform nenne, prüfe die verfügbare Standard- oder Pro-Variante und ihre Einstellungen. Nutze die Dokumentation dieser Variante. Markiere, was sich nicht bestätigen lässt.

Fehlt die Einstellungsbeschreibung, frage nach Beschreibung, Plattform, Dauer, Seitenverhältnis und Material. Frage nur nach fehlenden Angaben.

Erstelle einen Prompt anhand meiner Beschreibung. Beschreibe bei Text-to-Video Hauptmotiv, Handlung, Umgebung und Kamera. Konzentriere dich bei Image-to-Video auf die Animation sichtbarer Elemente.

Trenne Kamera- und Produktbewegung eindeutig. Bestimme Richtung, Tempo und Umfang. Ergänze keine unbestellten Schnitte oder Effekte. Passe bei einer Umrundung den Bewegungsumfang an den Produktteil an, der sichtbar bleiben muss.

Unterstützt die Integration einen negativen Prompt, erstelle separat eine kurze Liste unerwünschter Änderungen. Schließe keine Texte oder Logos aus, die im Bild bleiben sollen. Bewahre Markennamen und Etikettentexte.

Gib den Prompt im Codeblock, gegebenenfalls den negativen Prompt in einem zweiten Block und die Einstellungen auf Deutsch aus. Ergänze keine undokumentierten Marker oder Wortgewichtungen. Verwende für weitere Aufnahmen die vereinbarte Konfiguration.
```

---

## 6. Kling 2.6 Pro

### Plane Bild und Ton als eine Szene

Der Kling-2.6-Leitfaden beschreibt native Audiogenerierung. Er empfiehlt, Szene, Handlung und hörbare Ereignisse festzulegen. Bei Dialogen sind Sprecher, Wortlaut und Sprechweise wichtig. [Quelle: Kling 2.6 — Audio-Leitfaden](https://kling.ai/quickstart/klingai-video-26-audio-user-guide).

Ein übersichtlicher Prompt kann Bild und Ton in getrennten Abschnitten beschreiben. Beide sollten jedoch dasselbe Ereignis meinen. Soll das Abstellen einer Tasse hörbar sein, muss diese Handlung auch in der Bildbeschreibung stehen.

```text
A barista stands behind a small café counter, holding a white cup.
The camera starts in a medium shot and slowly moves closer as the
barista places the cup beside the coffee package.

After setting down the cup, the barista looks toward the customer
and says in a relaxed tone, in English:
"Good morning. Your coffee is ready."

Audio: a soft tap as the cup touches the counter, followed by the
barista's voice. Quiet café ambience continues in the background.
```

Die Kamera bewegt sich, nicht die „halbnahe Einstellung“. Die Einstellungsgröße beschreibt den Bildausschnitt. Im Beispiel ist außerdem klar, wann die Figur die Tasse abstellt, wann sie zu sprechen beginnt und an wen sie sich wendet.

Verwende bei zwei Sprechern feste Bezeichnungen wie „the barista“ und „the customer“. „She“ kann bei zwei Frauen im Bild mehrdeutig sein. Plane im ersten Versuch aufeinanderfolgende Aussagen ohne überlappende Stimmen.

### Achte auf die Dialogsprache

Die Dokumentation nennt chinesische und englische Sprache sowie die Übersetzung anderer Sprachen ins Englische. Plane daher keine polnische Werbung mit nativem polnischem Dialog, ohne die aktuelle Integration zu prüfen. Wird die Sprache nicht unterstützt, ist ein separat aufgenommener oder generierter Sprechertext eine Alternative. [Quelle: Kling 2.6 — Audio-Leitfaden](https://kling.ai/quickstart/klingai-video-26-audio-user-guide).

Eine englische Szenenbeschreibung erfordert keinen englischen Dialog in GROSSBUCHSTABEN. Nutze normale Schreibweise und Großbuchstaben dort, wo sie nötig sind, etwa bei Namen und Abkürzungen. [Quelle: fal — Kling 2.6 Pro, text-to-video](https://fal.ai/models/fal-ai/kling-video/v2.6/pro/text-to-video/api).

Kann die Plattform einer Figur eine gespeicherte Stimme zuweisen, nutze deren tatsächliche Kennung. Ein Beispiel wie `@VoiceName` erzeugt keine neue Stimme und funktioniert ohne passende Einrichtung nicht.

#### Start-Prompt für ChatGPT — Kling 2.6 Pro

```text
Hilf mir, Prompts für Kling 2.6 Pro zu schreiben. Erkläre auf Deutsch und schreibe fertige Prompts auf Englisch. Starte keine Videogenerierung.

Prüfe zuerst die verfügbare Dokumentation:
https://kling.ai/quickstart/klingai-video-26-audio-user-guide
https://fal.ai/models/fal-ai/kling-video/v2.6/pro/text-to-video/api

Fasse die Regeln für Bild, Ton und gesprochene Sprachen zusammen. Prüfe nach Nennung der Plattform den konkreten Modus, einschließlich Audio und negativem Prompt. Markiere nicht bestätigte Angaben.

Falls die Einstellungsbeschreibung fehlt, frage nach Beschreibung, Plattform, Dauer, Seitenverhältnis, Material und gegebenenfalls Dialog. Frage nur nach fehlenden Details. Ist die Beschreibung vollständig, erstelle sofort den Prompt.

Trenne Bild und Ton im Prompt, halte sie aber inhaltlich aufeinander abgestimmt. Ordne jeden Toneffekt einem Ereignis zu. Weise jede Aussage einer Figur zu und bestimme Tonfall und Tempo. Prüfe, ob Dialog und Handlungen in die Cliplänge passen.

Konzentriere dich bei Fotoanimationen auf Bewegung. Unterscheide Bildausschnitt und Kamerabewegung. Ergänze keine Figuren oder Gegenstände, die ich nicht verlange.

Bewahre Sprache und genauen Wortlaut des Dialogs. Wird polnische Sprache nicht unterstützt oder ist dies unbestätigt, erkläre das und schlage eine separate Sprecher-Tonspur vor. Übersetze Aussagen nicht eigenständig. Nutze nur tatsächliche Stimmkennungen meiner Plattform.

Gib den Prompt im Codeblock und die Einstellungen einschließlich Audio auf Deutsch aus. Ergänze einen negativen Prompt nur für einen unterstützten Modus. Nutze für weitere Einstellungen die zuvor vereinbarten Angaben.
```

---

## 7. Kling 3.0 / Kling 3.0 Pro

### Entscheide: eine Einstellung oder mehrere

Die Kling-3.0-Anleitung beschreibt den Multi-Shot-Modus für Sequenzen mit wechselnden Einstellungen. Sie nennt außerdem Elementreferenzen, die mit dem Startbild verknüpft sind. [Quelle: Kling 3.0 — Modellanleitung](https://kling.ai/quickstart/klingai-video-3-model-user-guide).

Entscheide vor dem Schreiben, ob du eine durchgehende Einstellung oder eine kurze Sequenz brauchst. Für eine flüssige Kamerafahrt nach vorn ohne Schnitte kannst du so beginnen:

```text
One continuous shot.
```

Ergänze später nicht „cut to a close-up“, denn das bedeutet einen Schnitt zu einer anderen Einstellung. Prüfe außerdem, ob die Plattformoptionen zur geplanten Umsetzung passen.

Beispiel einer Sequenz aus drei Einstellungen:

```text
Shot 1 — 4 seconds:
A medium shot of a coffee package and a cup on a kitchen table.
A hand enters from the right, gently turns the cup until its handle
points to the right, releases it, and leaves the frame.

Shot 2 — 4 seconds:
Cut to a close-up of the same package in the unchanged setting.
The camera slowly moves closer, keeping the front label in view.
The cup remains in the position established in the first shot.

Shot 3 — 4 seconds:
Cut to a wider, static view of the same tabletop arrangement.
Keep the package in the lower half of the frame, with clear space
above it for a title to be added during editing.
```

Die Aufteilung setzt 12 Sekunden und einen Modus voraus, der diese Sequenz unterstützt. Die Hand beendet ihre Aktion und verlässt das Bild vor dem ersten Schnitt. Die Tasse bleibt an ihrer neuen Position. So muss das Modell bei den Übergängen nicht selbst entscheiden, was mit diesen Elementen geschehen ist.

### Nutze dieselben Figuren- und Produktreferenzen

Lässt sich ein Produkt oder eine Figur als Referenzelement speichern, verwende dieses Element in allen Einstellungen. Eine lange Merkmalsbeschreibung ersetzt nicht das korrekte Einbinden der Referenz.

Ist einer Figur bereits eine bestimmte Stimme zugeordnet, beschreibe im nächsten Shot keine widersprüchlichen Stimmmerkmale. Die Kling-Anleitung weist auf solche Konflikte hin. [Quelle: Kling 3.0 — Modellanleitung](https://kling.ai/quickstart/klingai-video-3-model-user-guide).

### Sprache und Pro-Variante

Die Beispiele sind auf Englisch. Für generierte Sprache nennt der Leitfaden Chinesisch, Englisch, Japanisch, Koreanisch und Spanisch. Polnisch steht nicht auf der Liste; für andere Sprachen wird eine Übersetzung ins Englische beschrieben. [Quelle: Kling 3.0 — Modellanleitung](https://kling.ai/quickstart/klingai-video-3-model-user-guide).

Die Bezeichnung Pro verlangt an sich keinen anderen Prompt-Stil. Prüfe, welche Parameter und Funktionen sie beim jeweiligen Anbieter bezeichnet. [Quelle: Artlist — Kling-3-Familie](https://help.artlist.io/hc/en-us/articles/37026869403933-Kling-3-Model-Family).

#### Start-Prompt für ChatGPT — Kling 3.0 / Pro

```text
Hilf mir, Prompts für Kling 3.0 oder Kling 3.0 Pro vorzubereiten. Antworte auf Deutsch und schreibe den Generator-Text auf Englisch. Generiere keine Bilder oder Videos.

Prüfe zuerst die verfügbare Dokumentation:
https://kling.ai/quickstart/klingai-video-3-model-user-guide
https://help.artlist.io/hc/en-us/articles/37026869403933-Kling-3-Model-Family

Stelle die wichtigsten Regeln kurz vor. Prüfe nach Nennung meiner Plattform Modellvariante, Multi-Shot, Elementreferenzen, Audio und negativen Prompt. Sage, was sich nicht bestätigen ließ.

Falls die Einstellungsbeschreibung fehlt, frage nach Beschreibung, Plattform, Dauer, Seitenverhältnis und Material. Frage nur nach fehlenden Informationen.

Leite aus meiner Beschreibung ab, ob eine durchgehende Einstellung oder eine Sequenz nötig ist. Kombiniere eine Anweisung ohne Schnitte nicht mit Schnittbefehlen. Erstelle für Sequenzen getrennte Beschreibungen und Zeiten passend zum Modus. Achte auf die Kontinuität von Objektpositionen und Figurenhandlungen zwischen den Einstellungen.

Konzentriere dich bei der Animation des ersten Bilds auf Bewegung. Nutze nur tatsächlich angehängte Referenzen und vorhandene Elementnamen.

Ordne jede Aussage einer Figur zu. Bewahre Wortlaut und Dialogsprache und prüfe ihre Unterstützung. Überschreibe keine bereits mit einer Referenz verknüpfte Stimme und übersetze Dialoge nicht ohne Aufforderung.

Gib den fertigen Prompt oder die einzelnen Einstellungsbeschreibungen in Codeblöcken aus. Nenne Einstellungen separat auf Deutsch. Berücksichtige weitere Felder nur, wenn die Integration sie unterstützt. Nutze für weitere Aufnahmen das vereinbarte Modell, die Plattform und die Referenzen.
```

---

## 8. Kling 3.0 Turbo

### Prüfe zuerst Modus und Eingabeformat

Das API-Schema für Kling 3.0 Turbo Pro Text-to-Video beschreibt entweder einen einzelnen `prompt` oder eine `multi_prompt`-Struktur mit eigenen Beschreibungen und Zeiten je Einstellung. Das sind alternative Eingabeformen, keine zwei gleichzeitig auszufüllenden Felder. [Quelle: fal — Kling 3.0 Turbo Pro, API](https://fal.ai/models/fal-ai/kling-video/v3/turbo/pro/text-to-video/api).

Wähle in der grafischen Oberfläche zuerst den passenden Modus. Bietet die Plattform eigene Storyboard-Felder, ersetzt „Shot 1, Shot 2“ im normalen Textfeld deren Nutzung nicht.

Prüfe in der API-Dokumentation den **Input-Abschnitt des gewählten Modus**. Eine Seite kann auch Datentypen enthalten, die an anderer Stelle genutzt werden. Tauchen `negative_prompt` oder `generate_audio` weiter unten auf, heißt das nicht automatisch, dass dieser Modus den Parameter akzeptiert. [Quelle: fal — Kling 3.0 Turbo Pro, API](https://fal.ai/models/fal-ai/kling-video/v3/turbo/pro/text-to-video/api).

### Beschreibe Richtung, Tempo und Umfang der Bewegung

Die hier genannten Quellen beschreiben keine eigene Prompt-Syntax für Turbo. Du kannst mit denselben konkreten Sätzen beginnen wie bei Kling 3.0.

```text
One continuous product shot. The camera moves slowly to the right
along a small arc around the stationary coffee package, keeping
approximately the same distance from it.

The camera remains aimed at the package. Its front label stays
visible throughout, while the changing viewpoint creates gentle
parallax in the background.
```

Diese Beschreibung meint eine Bogenfahrt. Verwende sie nicht für eine geradlinige seitliche Fahrt. Das Bewegungstempo gehört in den Prompt; der Name der Modellvariante legt es nicht fest.

Englisch bleibt die Arbeitssprache. Prüfe Dialoge, Referenzen und zusätzliche Parameter für den gewählten Modus, statt Einstellungen vom normalen Kling 3.0 zu übernehmen.

#### Start-Prompt für ChatGPT — Kling 3.0 Turbo

```text
Hilf mir, Prompts für Kling 3.0 Turbo zu schreiben. Erkläre auf Deutsch und schreibe fertige Prompts auf Englisch. Generiere keine Videos.

Prüfe zuerst die verfügbare Dokumentation:
https://fal.ai/models/fal-ai/kling-video/v3/turbo/pro/text-to-video/api
https://console.higgsfield.ai/models/kling-video/v3.0-turbo/text-to-video/playground
https://kling.ai/quickstart/klingai-video-3-model-user-guide

Fasse die für diese Variante wichtigen Regeln zusammen. Prüfe nach Nennung der Plattform den konkreten Modus und seinen Input-Abschnitt. Gehe nicht davon aus, dass Parameter anderer Modelle auch in Turbo verfügbar sind. Benenne Unsicherheit durch fehlende Dokumentation ausdrücklich.

Fehlt die Einstellungsbeschreibung, frage nach Beschreibung, Plattform, Dauer, Seitenverhältnis und Material. Frage bekannte Informationen nicht erneut ab.

Erstelle für eine einzelne Einstellung einen stimmigen Prompt. Beschreibe für Sequenzen die einzelnen Einstellungen und Zeiten im verlangten Plattformformat. Behandle prompt und multi_prompt als alternative Eingabeformen, nicht als gleichzeitig auszufüllende Felder.

Bestimme Richtung, Tempo und Umfang der Kamerabewegung genau. Unterscheide seitliche Fahrt, Bogenfahrt, Kameradrehung und Brennweitenänderung. Beschreibe die Produktbewegung separat. Bewahre meine Idee ohne zusätzliche Schnitte, Figuren oder Effekte.

Behalte die Dialogsprache bei und prüfe die Sprachunterstützung des Modus. Berücksichtige Audio, Referenzen und negativen Prompt nur, wenn sie in dieser Integration verfügbar sind.

Gib den fertigen Text im Codeblock und die Einstellungen auf Deutsch aus. Nutze für weitere Einstellungen die zuvor vereinbarte Konfiguration.
```

---

## 9. Kling O3 / Kling 3.0 Omni

### Beschreibe bei der Bearbeitung die Änderung, nicht die ganze Szene neu

Unterscheide Kling O3 vom normalen Kling 3.0. Die Omni-Anleitung behandelt Referenzen, Elemente, Stimme und Storyboard und verweist für die Bearbeitung zusätzlich auf die O1-Dokumentation. [Quelle: Kling — 3.0-Omni-Anleitung](https://kling.ai/quickstart/klingai-video-3-omni-model-user-guide).

Für eine neue Szene brauchst du eine Beschreibung dessen, was entstehen soll. Bei vorhandenem Material ist die Änderungsanweisung wichtiger:

> Ersetze die Tasse in der Aufnahme durch die Tasse vom Referenzfoto. Bewahre Handlungsablauf, Kameraführung und Umgebung.

Das ist nicht dasselbe wie die Beschreibung einer neuen Einstellung in Runway Gen-4. Der direkte Befehl „ersetze“ hat hier ein konkretes Zielobjekt und eine Basisaufnahme.

Beispiel für die Bearbeitung einer Aufnahme, in der eine Hand eine Tasse hebt und wieder auf die Arbeitsplatte stellt:

```text
Replace the cup in the input video with the cup shown in the reference
image. Use the image only as a reference for the replacement cup,
not for the surrounding scene.

Keep the original hand movement, camera movement, tabletop, lighting,
and timing. Match the replacement cup to the original cup's position
and orientation throughout the shot.

Keep the fingers naturally wrapped around the handle, with correct
overlap between the hand and the cup. When the cup rests on the table,
maintain natural contact with the surface and a matching contact shadow.
```

Der letzte Absatz beschreibt die Beziehung zwischen Hand, Tassenhenkel und Arbeitsplatte. Er verlangt keine identischen Überdeckungen bei zwei möglicherweise unterschiedlich geformten Objekten, sondern einen natürlichen Kontakt.

### Lege den Bearbeitungsumfang und die Rolle jeder Datei fest

Wähle eine Basisaufnahme. Bestimme das zu ändernde Objekt, gegebenenfalls den Videoabschnitt und das Ergebnis. Ersetzt du nur die Verpackung, beschreibe Küche, Kleidung und Licht nicht erneut.

Ein Referenzfoto kann ausschließlich als Produktvorlage dienen. Schreibe das ausdrücklich, damit die Beschreibung nicht die Übernahme des ganzen Hintergrunds nahelegt.

Die Bearbeitungsanleitung beschreibt unter anderem Elementaustausch, Änderungen von Umgebung und Stil sowie Referenzbewegungen. Sie garantiert aber nicht, dass jeder Pixel außerhalb des geänderten Objekts identisch bleibt. [Quelle: Kling — O1-Anleitung](https://kling.ai/quickstart/klingai-video-o1-user-guide).

Bereite den Prompt auf Englisch vor. Prüfe Audiounterstützung für Generierung und Bearbeitung getrennt. Eine Funktion in einem Modus bestätigt nicht ihre Verfügbarkeit im anderen.

#### Start-Prompt für ChatGPT — Kling O3

```text
Hilf mir, Prompts für Kling O3 / Kling 3.0 Omni vorzubereiten. Antworte auf Deutsch und schreibe den fertigen Generator-Text auf Englisch. Starte keine Bild- oder Videogenerierung.

Prüfe zuerst die verfügbare Dokumentation:
https://kling.ai/quickstart/klingai-video-3-omni-model-user-guide
https://kling.ai/quickstart/klingai-video-o1-user-guide
https://help.artlist.io/hc/en-us/articles/37026869403933-Kling-3-Model-Family

Fasse die Regeln kurz zusammen. Prüfe nach Nennung der Plattform die Möglichkeiten des konkreten Modus. Sind Quellen nicht erreichbar oder klären sie einen Punkt nicht, benenne den Umfang der Unsicherheit.

Falls ich die Aufgabe nicht beschrieben habe, frage nach Beschreibung, Plattform, Material und nötigen Videoeinstellungen. Frage nur nach fehlenden Angaben.

Unterscheide neue Szenen, Referenzarbeit und Videobearbeitung. Bestimme bei der Bearbeitung die Basisaufnahme, das Zielobjekt, den Änderungsumfang und die zu erhaltenden Elemente. Baue nicht die ganze Szene neu, wenn ich nur einen Gegenstand ersetzen möchte.

Gib jeder Referenz eine klare Rolle. Nutze nur tatsächliche Anhänge und unterstützte Marker. Berücksichtige Objektposition, Kontakt mit Händen und Oberflächen, gegenseitige Überdeckung, Schatten und Bewegungskontinuität.

Formuliere das Erhalten unveränderter Elemente als Anforderung, nicht als Garantie pixelgenauer Identität. Prüfe Audio und negativen Prompt für den konkreten Modus, nicht nur die Modellfamilie. Bewahre die Dialogsprache und überprüfe ihre Unterstützung.

Gib einen Prompt im Codeblock und die Einstellungen auf Deutsch aus. Nutze für weitere Aufgaben die vereinbarten Angaben, außer ich ändere Modell, Plattform oder Arbeitsweise.
```

---

## 10. Veo 3.1

### Trenne Bildbeschreibung und Tonbeschreibung

Bei Veo ist Englisch eine durch die Google-Dokumentation gestützte Wahl, da sie vollständige Unterstützung zusichert. Die Sprache der Anweisung ist aber nicht mit der Unterstützung jeder Dialogsprache gleichzusetzen. [Quelle: Google — Veo in der Gemini API](https://ai.google.dev/gemini-api/docs/veo).

Beschreibe bei Textgenerierung Hauptmotiv, Umgebung, Handlung, Kamera und Licht. Beschreibe den Ton separat, aber bezogen auf dieselbe Szene.

```text
A close-up product shot of a coffee package beside a white cup
and saucer on a pale wooden table in a quiet kitchen.

The camera slowly moves forward toward the package. Steam rises
gently from the cup. Soft morning light enters from the left.

A hand enters from the right, places a teaspoon on the saucer,
and leaves the frame. The package remains stationary.

Audio: quiet kitchen ambience, the faint sound of a kettle in the
background, and a light clink as the metal teaspoon touches the
ceramic saucer.
```

In diesem Beispiel stehen Untertasse und Hand bereits in der Bildbeschreibung, nicht erst in der Tonanweisung. Das Geräusch ist dem Kontakt von Löffel und Untertasse zugeordnet.

Kürze bei Fotoanimationen die Beschreibung des Aussehens. Google empfiehlt ein hochwertiges Eingabebild und rät von unnötigen Wiederholungen seines Inhalts ab. Nutze das Löffelbeispiel nur, wenn es zu Foto und Handlung passt. [Quelle: Google Cloud — bewährte Verfahren für die Videogenerierung](https://docs.cloud.google.com/gemini-enterprise-agent-platform/models/video/best-practice).

#### Dialoge

Gib Sprecher, genauen Wortlaut, Sprache und Tonfall an. Die Textmenge muss zur Cliplänge passen.

```text
The barista looks toward the customer and says warmly, in English:
"Take a moment. Your coffee is ready."
```

Prüfe für polnische Dialoge die gewählte Integration und teste sie vor einer größeren Produktion. Zugesicherte Unterstützung englischer Prompts bestätigt keine zuverlässige Erzeugung polnischer Sprache.

### Negativer Prompt

Google empfiehlt, unerwünschte Elemente ohne Formulierungen wie „no“ und „don't“ aufzulisten. Diese Liste gehört in das separate Feld, sofern die Plattform eines anbietet. [Quelle: Google Cloud — Veo-Prompt-Leitfaden](https://cloud.google.com/vertex-ai/generative-ai/docs/video/video-gen-prompt-guide).

```text
duplicate products, distorted packaging, altered label design,
flickering exposure, sudden camera shake
```

Schreibe nicht pauschal „text“, wenn das Produktetikett sichtbar bleiben soll. Die Liste soll konkrete Fehler ausschließen, keine für die Werbung nötigen Elemente.

### Referenzen sowie erstes und letztes Bild

Ein Produktfoto als Referenz muss nicht das Startbild sein. Gib im Referenzmodus die zu übernehmenden Merkmale an. Beschreibe bei erstem und letztem Bild den Ablauf, der beide verbindet.

Die Google-Dokumentation beschreibt auch Videoverlängerung, deren Verfügbarkeit jedoch von der Variante abhängt. Übertrage nicht den gesamten Funktionsumfang auf Lite. [Quelle: Google — Veo in der Gemini API](https://ai.google.dev/gemini-api/docs/veo).

#### Start-Prompt für ChatGPT — Veo 3.1

```text
Hilf mir, Prompts für Veo 3.1 zu schreiben. Antworte auf Deutsch und erstelle fertige Prompts auf Englisch. Generiere keine Videos.

Prüfe zuerst die verfügbare Dokumentation:
https://ai.google.dev/gemini-api/docs/veo
https://cloud.google.com/vertex-ai/generative-ai/docs/video/video-gen-prompt-guide
https://docs.cloud.google.com/gemini-enterprise-agent-platform/models/video/best-practice

Stelle die Regeln für Bild, Ton und Referenzen kurz vor. Prüfe nach Nennung der Plattform die verfügbaren Modi und Einstellungen. Markiere nicht bestätigte Informationen.

Falls die Einstellungsbeschreibung fehlt, frage nach Beschreibung, Plattform, Dauer, Seitenverhältnis, Material und gewünschtem Ton. Frage nur nach fehlenden Angaben. Ist die Beschreibung vollständig, erstelle sofort den Prompt.

Definiere bei Text-to-Video Aussehen, Handlung, Kamera und Licht. Konzentriere dich bei Image-to-Video auf Bewegung. Unterscheide Referenzfoto, Startbild und Endbild und ordne ihnen die richtigen Rollen zu.

Beschreibe den Ton separat, aber passend zum Bild. Soll eine bestimmte Handlung hörbar sein, muss sie im Szenenablauf vorkommen. Ordne Dialoge Figuren zu und bewahre Wortlaut und Sprache. Prüfe die Sprachunterstützung, statt Aussagen selbst zu übersetzen.

Bietet die Integration einen negativen Prompt, erstelle eine kurze Liste unerwünschter Elemente ohne „no“ und „don't“. Schließe keine Etiketten, Texte oder Logos aus, die erhalten bleiben sollen.

Gib Prompt und gegebenenfalls negativen Prompt in getrennten Codeblöcken aus. Nenne die Einstellungen auf Deutsch unter Berücksichtigung verfügbarer Dauer und Modi. Nutze für weitere Aufnahmen die vereinbarte Konfiguration.
```

---

## 11. Veo 3.1 Fast

### Nutze dieselben Regeln, prüfe aber die Einstellungen der Variante

Google nennt keine eigene Syntax für Fast. Ausgangspunkt bleiben Szenenbeschreibung, Kamerabewegung, Ton und gegebenenfalls ein negativer Prompt. Prüfe die verfügbaren Einstellungen der konkreten Variante. [Quelle: Google — Veo in der Gemini API](https://ai.google.dev/gemini-api/docs/veo).

Wähle für den ersten Test einen leicht beurteilbaren Effekt: etwa eine Annäherung der Kamera bei unbeweglichem Produkt.

```text
One continuous shot based on the starting image. The camera slowly
moves forward toward the coffee package, keeping its front label
fully in view. The package remains fixed on the table.
Steam rises gently from the cup.

Audio: quiet indoor ambience.
```

Behalte beim Wechsel von Fast zu einer anderen Variante Prompt und Material bei, wenn du Ergebnisse vergleichen willst. Betrachte den Wechsel aber nicht als Hochskalieren eines fertigen Videos. Es entsteht eine neue Generierung, deren Ablauf abweichen kann.

Schreibe die Anweisung auf Englisch, entsprechend der für die Veo-Familie gewählten Sprache. [Quelle: Google — Veo in der Gemini API](https://ai.google.dev/gemini-api/docs/veo).

#### Start-Prompt für ChatGPT — Veo 3.1 Fast

```text
Hilf mir, Prompts für Veo 3.1 Fast vorzubereiten. Erkläre auf Deutsch und schreibe den Generator-Text auf Englisch. Generiere keine Videos.

Prüfe zuerst die verfügbare Dokumentation:
https://ai.google.dev/gemini-api/docs/veo
https://cloud.google.com/vertex-ai/generative-ai/docs/video/video-gen-prompt-guide

Fasse die wichtigsten Regeln zusammen. Prüfe nach Nennung der Plattform die Fast-Einstellungen. Schreibe dieser Variante keine Einschränkungen oder eigene Syntax ohne Dokumentationsbeleg zu. Markiere Lücken in den Quellen.

Fehlt die Einstellungsbeschreibung, frage nach Beschreibung, Plattform, Dauer, Seitenverhältnis, Material und gewünschtem Ton. Frage nur nach fehlenden Angaben. Reichen die Informationen aus, erstelle sofort den Prompt.

Bewahre meine Idee. Konzentriere dich bei Fotoanimationen auf Kamera-, Objekt- und Umgebungsbewegung. Passe die Anzahl der Handlungen an die Cliplänge an. Ergänze keine Schnitte oder neuen Szenenelemente eigenständig.

Beschreibe den Ton separat und passend zum Bild. Ordne Dialoge einer Figur zu, bewahre Wortlaut und Sprache und prüfe die Sprachunterstützung. Übersetze keine Aussagen ohne meine Bitte.

Ergänze einen negativen Prompt nur im unterstützten Modus, als Liste ohne „no“ und „don't“. Stelle einen Variantenwechsel nicht als Möglichkeit dar, ein vorheriges Video identisch in höherer Qualität nachzubilden.

Gib den Prompt im Codeblock und die Einstellungen auf Deutsch aus. Verwende für weitere Aufnahmen die zuvor vereinbarten Angaben.
```

---

## 12. Veo 3.1 Lite

### Passe die Idee an die verfügbaren Eingaben an

Laut der unten verlinkten Gemini-API-Dokumentation unterstützt Lite Text- und Bildgenerierung sowie erstes und letztes Bild. Nicht unterstützt werden `referenceImages`, das Verlängern vorhandener Videos und 4K-Generierung. Prüfe vor der Umsetzung, ob diese Angaben weiterhin für den gewählten Modus gelten. [Quelle: Google — Veo in der Gemini API](https://ai.google.dev/gemini-api/docs/veo).

Mehrere Fotodateinamen im Prompt ersetzen keinen fehlenden Referenzeingang. Möchtest du eine bestimmte Produktkomposition animieren, bereite ein passendes Startbild vor und beschreibe die Bewegung.

Das folgende Beispiel setzt ein Produktfoto voraus, bei dem die Kamera etwas oberhalb der Produktmitte steht:

```text
The camera slowly lowers to the height of the package's front label,
keeping the same horizontal distance from the product. It adjusts
its tilt smoothly so that the package remains in frame, ending
with the label centered in the image.

The package and cup remain stationary. Steam rises gently from
the cup, and the lighting stays consistent with the starting image.
```

Die Beschreibung trennt das Absenken der Kamera von der Änderung ihrer Blickrichtung. „Die Kamera bewegt sich nach unten zum Produkt“ lässt offen, ob eine Abwärtsfahrt, eine Neigung oder eine diagonale Annäherung gemeint ist.

Füge das Endbild in das vorgesehene Feld ein, sofern vorhanden. „End frame: attached image“ weist einen normalen Anhang nicht automatisch der Endbildfunktion zu.

Englisch bleibt die Arbeitssprache. Kürzere Szenen sind zum Testen praktisch, aber an sich keine dokumentierte Anforderung von Lite.

#### Start-Prompt für ChatGPT — Veo 3.1 Lite

```text
Hilf mir, Prompts für Veo 3.1 Lite zu schreiben. Antworte auf Deutsch und schreibe fertige Prompts auf Englisch. Starte keine Videogenerierung.

Prüfe zuerst die verfügbare Dokumentation:
https://ai.google.dev/gemini-api/docs/veo
https://cloud.google.com/vertex-ai/generative-ai/docs/video/video-gen-prompt-guide

Prüfe Angaben speziell zu Lite. Verifiziere nach Nennung der Plattform auch die Funktionen ihrer Integration. Schreibe Lite keine Referenzeingänge, Videoverlängerung oder Auflösungen zu, nur weil eine andere Veo-Variante sie unterstützt. Markiere unbestätigte Informationen.

Fehlt die Einstellungsbeschreibung, frage nach Beschreibung, Plattform, Dauer, Seitenverhältnis und Material. Frage nur nach fehlenden Angaben.

Erstelle einen Prompt anhand der Beschreibung, passend zu Textgenerierung oder Bildanimation. Nutze erstes und letztes Bild nur bei Unterstützung durch den Modus. Behandle ein Foto nicht als übermittelt, wenn es nicht am richtigen Eingang angehängt wurde.

Beschreibe Handlung und Kamerabewegung klar. Unterscheide Positionsänderung von Drehung oder Neigung. Stimme Ton und Bild aufeinander ab. Bewahre die Dialogsprache und prüfe ihre Unterstützung. Ergänze einen negativen Prompt erst nach Bestätigung des passenden Felds.

Gib den Prompt im Codeblock und Einstellungen auf Deutsch aus. Benötigt die Idee eine nicht verfügbare Funktion, erkläre das Problem und schlage die nächstliegende umsetzbare Lösung vor. Behalte die Einstellungen für weitere Aufnahmen bei.
```

---

## 13. Runway Gen-4.5

### Beginne mit einer konkreten Beschreibung, nicht mit der Prompt-Länge

Runway betont, dass es weder eine Pflichtformel noch eine ideale Wortzahl gibt. Natürliche Sätze helfen, Beziehungen zwischen Elementen zu beschreiben. Die Reihenfolge der Merkmale ist kein dokumentiertes Gewichtungssystem. [Quelle: Runway — Text-to-Video-Leitfaden](https://help.runwayml.com/hc/en-us/articles/42460036199443-Text-to-Video-Prompting-Guide).

Beschreibe bei **Text-to-Video** Aussehen und Bewegung. Bei **Image-to-Video** legt das Foto Komposition, Licht und Stil des Startbilds fest. Der Prompt sollte sich auf das Geschehen konzentrieren. [Quelle: Runway — Gen-4.5](https://help.runwayml.com/hc/en-us/articles/46974685288467-Creating-with-Gen-4-5).

Beispiel für ein Produktfoto:

```text
The camera moves slowly forward and slightly to the right along
a straight diagonal path. The coffee package stays fixed on the
table, with its front label visible throughout.

Steam rises gently from the cup. Near the end of the shot, the camera
gradually slows to a stop and holds a close-up of the package.
```

Die Beschreibung legt eine gerade Kamerafahrt statt eines Bogens fest. Auch das Ende ist klar: Die Bewegung stoppt allmählich, danach hält die Kamera den Ausschnitt. Nach dem ersten Versuch kannst du die Fahrstrecke oder die Produktgröße im letzten Bild ändern.

### Du kannst einzelne Phasen beschreiben

Nicht jede Szene muss auf eine einzige Handlung reduziert werden. Die Gen-4.5-Dokumentation behandelt natürliche Handlungsfolgen und ungefähre Zeitmarken. [Quelle: Runway — Image-to-Video-Leitfaden](https://help.runwayml.com/hc/en-us/articles/48324313115155).

Das folgende Beispiel setzt eine Tasse im Vordergrund und eine Verpackung dahinter voraus:

```text
The camera remains stationary. The cup in the foreground is in focus,
while the coffee package behind it is softly out of focus.

A hand enters from the right, grasps the cup by its handle, and lifts
it out of the frame. As the cup leaves, focus shifts smoothly to the
coffee package, bringing its front label into sharp focus.
```

Die Fokusverlagerung wird nicht mit einer unbestimmten Kamerabewegung kombiniert. Zuerst ist klar, was scharf ist, dann, was den Vordergrund verlässt, und schließlich, welches Objekt scharf gestellt wird. Der Ablauf muss weiterhin in die Cliplänge passen.

### Prüfe, ob die Bewegung zum Foto passt

Bewegungsunschärfe, eine geneigte Körperhaltung oder die Anordnung von Gegenständen können eine Handlungsrichtung nahelegen. Beschreibt der Prompt das Gegenteil, widersprechen sich Bild und Anweisung. Runway weist auf solche visuellen Hinweise hin. [Quelle: Runway — Image-to-Video-Leitfaden](https://help.runwayml.com/hc/en-us/articles/48324313115155).

Die Beispiele verwenden Englisch und positive Beschreibungen des gewünschten Ergebnisses. Ergänze keinen separaten negativen Prompt ohne Bestätigung des Felds. Plane den Ton getrennt, statt seine Unterstützung durch das Animationsmodell vorauszusetzen.

#### Start-Prompt für ChatGPT — Runway Gen-4.5

```text
Hilf mir, Prompts für Runway Gen-4.5 vorzubereiten. Erkläre auf Deutsch und schreibe fertige Prompts auf Englisch. Generiere keine Videos.

Prüfe zuerst die verfügbare Dokumentation:
https://help.runwayml.com/hc/en-us/articles/46974685288467-Creating-with-Gen-4-5
https://help.runwayml.com/hc/en-us/articles/42460036199443-Text-to-Video-Prompting-Guide
https://help.runwayml.com/hc/en-us/articles/48324313115155-Image-to-Video-Prompting-Guide

Fasse die Regeln kurz zusammen. Prüfe nach Nennung der Plattform unterstützte Modi und Einstellungen. Markiere nicht bestätigte Angaben.

Fehlt die Einstellungsbeschreibung, frage nach Beschreibung, Plattform, Dauer, Seitenverhältnis und gegebenenfalls Foto. Frage nur nach fehlenden Daten.

Erstelle einen Prompt gemäß meiner Idee. Beschreibe bei Text-to-Video Aussehen und Bewegung. Konzentriere dich bei Image-to-Video auf Animation, Kamera, Richtung und Tempo, ohne den gesamten Fotoinhalt zu wiederholen.

Schreibe natürliche, konkrete Sätze. Setze kein künstliches Wortlimit und behandle die Reihenfolge von Begriffen nicht als Gewichtungssystem. Beschreibe Phasen und ungefähre Zeiten nur, wenn sie den Ablauf verdeutlichen. Prüfe, ob die Handlungen in die Cliplänge passen.

Unterscheide Kamerabewegung, Fokusverlagerung und Motivbewegung. Prüfe die Übereinstimmung mit dem Eingabebild. Nutze positive Ergebnisbeschreibungen statt langer Verbotslisten. Ergänze keinen unbestätigten negativen Prompt und keine unbestätigte Audiogenerierung.

Gib den Prompt im Codeblock und die Einstellungen auf Deutsch aus. Erkläre Widersprüche kurz und schlage eine Korrektur vor. Nutze für weitere Einstellungen die bisher vereinbarten Werte.
```

---

## 14. Runway Gen-4 Turbo

### Beginne mit dem Startbild

Im dokumentierten Runway-Workflow benötigt Gen-4 Turbo ein Eingabebild. Eine reine Textbeschreibung ersetzt kein fehlendes Startbild. [Quelle: Runway — Modellkatalog](https://docs.dev.runwayml.com/guides/models/).

Der Gen-4-Leitfaden empfiehlt einen einfachen Einstieg mit schrittweisem Ergänzen nötiger Details. Beschreibe die Bewegung von Motiv, Kamera und Umgebung. [Quelle: Runway — Gen-4-Leitfaden](https://help.runwayml.com/hc/en-us/articles/39789879462419-Gen-4-Video-Prompting-Guide).

```text
The camera slowly moves forward toward the coffee package.
The package and cup remain stationary. Steam rises gently from
the cup, while the package's front label stays visible throughout.
```

Funktioniert die Annäherung wie geplant, kannst du eine kleine seitliche Bewegung ergänzen. Kombinierst du sofort Orbit, Zoom, Fokusverlagerung und Produktbewegung, wird die Ursache eines Problems schwerer erkennbar.

### Beschreibe das gewünschte Ergebnis statt Verboten

Runway rät ausdrücklich von negativen Formulierungen in Gen-4-Prompts ab. Verwende statt „no camera movement“:

```text
The camera remains stationary.
```

Schreibe statt „the package must not move“:

```text
The package remains stationary.
```

Beide Sätze beschreiben den gewünschten Zustand eindeutig. Eine lange Liste wie „no blur, no deformation, no extra objects“ ist kein empfohlener Ersatz für eine konkrete Einstellungsbeschreibung. [Quelle: Runway — Gen-4-Leitfaden](https://help.runwayml.com/hc/en-us/articles/39789879462419-Gen-4-Video-Prompting-Guide).

Englisch bleibt die Arbeitssprache. Misslingt eine Generierung, prüfe Startbild und Bewegungskonsistenz, bevor du den Prompt verlängerst.

#### Start-Prompt für ChatGPT — Runway Gen-4 Turbo

```text
Hilf mir, Prompts für Runway Gen-4 Turbo zu schreiben. Antworte auf Deutsch und schreibe den fertigen Generator-Text auf Englisch. Generiere keine Bilder oder Videos.

Prüfe zuerst die verfügbare Dokumentation:
https://help.runwayml.com/hc/en-us/articles/39789879462419-Gen-4-Video-Prompting-Guide
https://docs.dev.runwayml.com/guides/models/

Fasse die für Fotoanimationen wichtigen Regeln zusammen. Prüfe nach Nennung der Plattform die verfügbaren Einstellungen. Markiere nicht bestätigte Angaben.

Falls kein Startbild angehängt ist, frage danach. Ergänze fehlende Daten: Bewegungsbeschreibung, Plattform, Dauer und Seitenverhältnis. Frage bereits gelieferte Angaben nicht erneut ab.

Erstelle anhand von Foto und Beschreibung einen Prompt. Behandle das Bild als Grundlage für das Aussehen der Szene. Konzentriere dich auf Bewegungen von Objekten, Kamera und Umgebung, statt jedes Bilddetail erneut zu beschreiben.

Nutze positive Beschreibungen des gewünschten Ergebnisses. Schreibe statt eines Bewegungsverbots, dass Kamera oder Gegenstand unbeweglich bleiben. Ergänze keinen negativen Prompt, keine Wortgewichte und keine höflichen Einleitungen wie „please add“.

Bewahre meine Idee und erstelle eine stimmige Einstellung. Füge keine Schnitte oder unabhängigen Bewegungen ohne Aufforderung hinzu. Prüfe, ob die geplante Animation dem Foto widerspricht.

Gib den Prompt im Codeblock und die Einstellungen auf Deutsch aus. Nutze für weitere Fotos die zuvor vereinbarte Konfiguration.
```

---

## 15. MiniMax Hailuo 2.3 Fast

### Nutze die passenden Kamerabefehle

Die MiniMax-Dokumentation beschreibt Hailuo 2.3 Fast als Image-to-Video-Variante, die ein Startbild und eine textliche Beschreibung der Animation verarbeitet. Sie führt außerdem Kamerabefehle in eckigen Klammern auf. [Quelle: MiniMax — image-to-video](https://platform.minimax.io/docs/api-reference/video-generation-i2v).

| Befehl | Beabsichtigte Bewegung |
| --- | --- |
| `[Push in]` | Heranfahrt: Die Kamera nähert sich dem Motiv. |
| `[Truck right]` | Seitliche Kamerafahrt nach rechts, also eine Änderung der Kameraposition. |
| `[Pan right]` | Schwenk nach rechts, ohne die Kamera seitlich zu versetzen. |
| `[Tilt up]` | Neigung der Kamera nach oben: Die Blickrichtung ändert sich, die Kamera wird nicht angehoben. |
| `[Static shot]` | Unbewegte Kamera mit festem Bildausschnitt. |

Der Befehl legt die Art der Bewegung fest. Präzisiere Tempo und Objektverhalten in einem normalen Satz:

```text
[Push in]
The camera moves slowly and smoothly toward the coffee package,
keeping its front label fully in view.

The package remains stationary on the table. Steam rises gently
from the cup. The shot ends on a close-up of the package.
```

Schreibe den Prompt auf Englisch und behalte die ursprüngliche Schreibweise der Befehle bei. Übersetze den Inhalt der Klammern nicht ins Deutsche.

### Kombiniere Bewegungen nur bei Bedarf

Laut Dokumentation lassen sich mehrere Bewegungen in einem Klammerpaar kombinieren; empfohlen werden höchstens drei gleichzeitige Befehle. Verwende beim ersten Test am besten nur einen. So lässt sich leichter beurteilen, ob das Modell die richtige Bewegung ausführt. [Quelle: MiniMax — image-to-video](https://platform.minimax.io/docs/api-reference/video-generation-i2v).

Prüfe auch die Einstellung `prompt_optimizer`. Die Dokumentation beschreibt die automatische Überarbeitung des Prompts und die Möglichkeit, sie auszuschalten. Wenn du eigene, präzise Beschreibungen vergleichst, kann die Arbeitsweise des Optimierers die Bewertung der Ergebnisse beeinflussen. [Quelle: MiniMax — image-to-video](https://platform.minimax.io/docs/api-reference/video-generation-i2v).

### Übertrage keine Funktionen anderer MiniMax-Modelle

In der unten verlinkten Dokumentation bezieht sich der separate Modus für erstes und letztes Bild auf Hailuo-02. Das bestätigt keine Unterstützung des letzten Bildes in Hailuo 2.3 Fast. [Quelle: MiniMax — erstes und letztes Bild](https://platform.minimax.io/docs/api-reference/video-generation-fl2v).

Ebenso bestätigt die für H3 beschriebene Audiofunktion nicht ihre Verfügbarkeit in Hailuo 2.3 Fast. Plane den Ton bei diesem Workflow separat, sofern die Dokumentation der konkreten Integration nichts anderes angibt.

#### Start-Prompt für ChatGPT — Hailuo 2.3 Fast

```text
Hilf mir, Prompts für MiniMax Hailuo 2.3 Fast vorzubereiten. Gib Erklärungen auf Deutsch und Generator-Prompts auf Englisch aus. Generiere keine Videos.

Prüfe zunächst die verfügbare Dokumentation:
https://platform.minimax.io/docs/api-reference/video-generation-i2v
https://platform.minimax.io/docs/api-reference/video-generation-fl2v
https://hailuoai.video/tools/hailuo-2-3-model

Fasse die Regeln zur Fotoanimation und die Kamerabefehle kurz zusammen. Sobald du die Plattform kennst, prüfe die Funktionen ihrer Integration. Kennzeichne, was sich nicht bestätigen ließ.

Falls ich kein Startbild angehängt habe, bitte darum. Ergänze fehlende Angaben: Beschreibung der Einstellung, Plattform, Dauer und Seitenverhältnis. Frage nicht erneut nach bereits genannten Informationen.

Erstelle einen Prompt, der sich auf die Animation des Fotos konzentriert. Unterstützt die Integration MiniMax-Befehle, wähle den passenden Befehl aus der Dokumentation und behalte seine ursprüngliche Schreibweise in eckigen Klammern bei.

Unterscheide Kamerafahrt, Schwenk, Neigung und Zoom. Bestimme Tempo und Bewegungsumfang. Kombiniere keine Bewegungen, sofern meine Beschreibung das nicht verlangt. Beziehe dich ausschließlich auf ein tatsächlich angehängtes Bild.

Prüfe die Verfügbarkeit von prompt_optimizer. Erläutere diese Einstellung außerhalb des Prompts und weise darauf hin, wenn sie den Text vor der Generierung automatisch umschreiben lässt.

Schreibe diesem Modell keine Funktionen von Hailuo-02 oder H3 zu. Berücksichtige letztes Bild, Audio und negativen Prompt nur nach bestätigter Unterstützung im gewählten Modus.

Gib den Prompt in einem Codeblock und die Einstellungen auf Deutsch aus. Verwende für weitere Fotos die bereits vereinbarte Konfiguration.
```

---

## 16. MiniMax H3

### Unterscheide Cloud, offene Modellgewichte und 2K-Modus

MiniMax H3 erzeugt Videos mit Stereoton. Unterstützt werden Text, erstes und letztes Bild sowie Referenzmaterial; die offiziell angegebene Dauer liegt bei 4–15 Sekunden. Die öffentliche Basisversion arbeitet standardmäßig mit 768p und 24 Bildern pro Sekunde. [Quelle: MiniMax — Videogenerierung](https://platform.minimax.io/docs/guides/video-generation).

Die offenen Gewichte von H3 lassen sich in ComfyUI ausführen. Fertige Workflows umfassen Text-to-Video, FL2VA zur Animation von erstem und letztem Bild sowie Ref2VA für Referenzmaterial. Dabei können Referenzmarkierungen wie `<Picture 1>`, `<Video 1>` und `<Audio 1>` verwendet werden. Prüfe immer die Syntax der gewählten Integration. [Quelle: ComfyUI — MiniMax-H3-Workflow](https://docs.comfy.org/tutorials/video/minimax/minimax-h3-native).

Turbo LoRA kann die Anzahl der Schritte bei lokaler Generierung reduzieren, macht aus H3 aber weder H3 Max noch H3 Max Turbo. Das Modul H3-Regenerate-2K wurde nicht für die lokale Installation veröffentlicht; der Hersteller bietet diesen Prozess über eine API an. Ein gewöhnlicher Upscaler ist kein gleichwertiger Ersatz. [Quelle: Hugging Face — MiniMax H3](https://huggingface.co/MiniMaxAI/MiniMax-H3).

### Lizenz und Hardware in Polen

**Die Community-Lizenz von H3 schließt die Europäische Union und damit auch Polen aus.** Vor dem Herunterladen der Gewichte zur lokalen Nutzung müssen die erforderlichen Rechte geklärt sein. Die von Comfy angebotene Professional-Lizenz beginnt bei 5.000 USD pro Monat. Die Nutzung eines lizenzierten Cloud-Dienstes verschafft dir keine Lizenz für eine eigene Installation. [Quelle: Comfy — MiniMax-Lizenz](https://comfy.org/minimax/license).

ComfyUI beschreibt Varianten, die den gesamten Speicherbedarf auf rund 42,5 GB reduzieren, sowie die Möglichkeit, das Modell mit Offloading sogar auf einer RTX 3060 auszuführen. Das bedeutet nicht, dass 42,5 GB VRAM benötigt werden. Die folgenden Werte sind ein vorsichtiger Ausgangspunkt, kein garantiertes Minimum für jeden Workflow. [Quelle: ComfyUI — H3-Unterstützung](https://blog.comfy.org/p/minimax-h3-day-0-support-in-comfyui).

| Komponente | Ausgangspunkt für Tests | Häufigere Nutzung |
| --- | --- | --- |
| Grafikkarte | NVIDIA mit 12 GB VRAM, speichersparender Konfiguration und Offloading | NVIDIA mit 24 GB VRAM und passenden Gewichten |
| Arbeitsspeicher | 64 GB | Je nach Workflow 64–128 GB |
| Laufwerk | NVMe-SSD mit 100–150 GB freiem Speicher | Zusätzliche Reserve für Modelle und Arbeitsdateien |
| Erster Test | Kurzer Clip, geringere Auflösung, eine Generierung | 768p und längere Einstellungen erst nach Messung des Speicherbedarfs |

Versprich keine pauschale Generierungszeit. Das Modell überhaupt auszuführen und täglich viele Tests komfortabel zu erstellen, sind unterschiedliche Anforderungen.

#### Start-Prompt für ChatGPT — MiniMax H3

```text
Hilf mir, Prompts für MiniMax H3 vorzubereiten. Antworte auf Deutsch und schreibe fertige Generator-Prompts auf Englisch. Generiere keine Videos.

Prüfe zuerst die MiniMax-H3-Dokumentation zu Text, erstem und letztem Bild sowie Referenzmaterial. Unterscheide zwischen offizieller API, lokalen ComfyUI-Workflows und den Funktionen meiner Plattform.

Falls ich die Einstellung noch nicht beschrieben habe, frage nach Plattform, Modus, Dauer, Seitenverhältnis, Materialien und gewünschtem Ton. Frage nur nach fehlenden Angaben. Weise jedem Referenzmaterial eine konkrete Rolle zu.

Beschreibe Kamera- und Objektbewegungen getrennt. Lege bei mehreren Handlungen Reihenfolge und Ende der Einstellung fest. Übernimm keine Hailuo-Befehle oder H3-Max-Einstellungen ohne bestätigte Unterstützung.

Geht es um eine lokale Installation in Polen, prüfe zuerst Lizenz, Hardware, ComfyUI-Version, Quantisierung und Offloading. Setze Turbo LoRA nicht mit H3 Max Turbo gleich und versprich keinen lokalen Regenerate-2K-Prozess.

Gib den Prompt in einem Codeblock aus und erläutere Einstellungen sowie Einschränkungen auf Deutsch.
```

#### Anweisung für Codex — lokalen Test vorbereiten

```text
Bereite auf diesem Computer eine lokale Installation von MiniMax H3 in ComfyUI vor.

Ermittle zuerst Betriebssystem, GPU, VRAM, RAM, Treiber und freien Speicherplatz. Prüfe die aktuelle Dokumentation von MiniMax und ComfyUI. Überprüfe die Lizenzbedingungen für einen Nutzer in Polen. Ist eine gesonderte Genehmigung erforderlich, informiere mich und lade keine Gewichte herunter, bis die Rechte bestätigt sind.

Bereite nach der Bestätigung eine isolierte Installation vor, wähle kompatible PyTorch- und Bibliotheksversionen, lade nur die offiziellen Dateien für einen Image-to-Video-Workflow herunter, richte Quantisierung und Offloading ein und führe einen kurzen Test mit Zeit- und Speichermessung durch.

Setze lokales H3 oder Turbo LoRA nicht mit H3 Max gleich. Nutze ohne meine Zustimmung keine kostenpflichtige API, ändere keine Treiber und deaktiviere keine Sicherheitsmaßnahmen.
```

---

## 17. MiniMax H3 Max

### Behandle H3 Max als Cloud-Variante

H3 Max ist eine Variante, die auf bessere Befolgung von Anweisungen und schnellere Generierung abgestimmt ist. MiniMax bietet 480p und 768p, die fal-Integration zusätzlich 1080p. Die überprüften Angebote betreffen Cloud-Dienste und APIs. Übertrage Installationsanleitungen für die offenen Gewichte des normalen H3 nicht auf H3 Max. [Quellen: MiniMax — Videogenerierung](https://platform.minimax.io/docs/guides/video-generation), [fal — MiniMax H3 Max](https://fal.ai/minimax-h3-max).

Prüfe vor der Generierung die gewählte Auflösung, Dauer, Eingabeart und automatische Prompt-Erweiterung. Dokumentiert die Plattform kein separates Feld für einen negativen Prompt, schreibe die Anforderungen an das Bild in die Hauptbeschreibung.

#### Start-Prompt für ChatGPT — MiniMax H3 Max

```text
Hilf mir, Prompts für MiniMax H3 Max zu schreiben. Antworte auf Deutsch und erstelle fertige Prompts auf Englisch. Generiere keine Videos.

Prüfe zuerst die aktuelle Dokumentation von MiniMax und meiner Integration. Unterscheide H3, H3 Max, H3 Max Turbo und Hailuo. Gehe nicht davon aus, dass ihre Funktionen und Einstellungen identisch sind.

Falls Angaben fehlen, frage nach Plattform, Beschreibung der Einstellung, Dauer, Auflösung, Seitenverhältnis, Materialien und Ton. Erstelle eine zusammenhängende Einstellung, beschreibe die Reihenfolge der Handlungen und trenne Kamera- von Objektbewegungen.

Prüfe, wie die automatische Prompt-Erweiterung funktioniert. Berücksichtige negativen Prompt, zusätzliche Referenzen und Audio nur nach bestätigter Unterstützung im konkreten Modus. Stelle H3 Max nicht als Modell mit öffentlichen Gewichten zur lokalen Installation dar.

Gib einen Prompt in einem Codeblock und die Einstellungen auf Deutsch aus.
```

---

## 18. MiniMax H3 Max Turbo

### Unterscheide H3, H3 Max und H3 Max Turbo

Laut fal sind H3 Max und H3 Max Turbo von fal entwickelte Varianten auf Basis von MiniMax H3. Sie sind nicht mit Hailuo 2.3 gleichzusetzen; identische Eingaben und Parameter dürfen nicht vorausgesetzt werden. [Quelle: fal — MiniMax H3 Max](https://fal.ai/minimax-h3-max).

**Gemessen am Generierungspreis gehört H3 Max Turbo zu den stärksten Kandidaten für günstige Werbetests.** Das macht es weder automatisch zum qualitativ besten Modell noch zum günstigsten Angebot auf dem gesamten Markt. Vergleiche letztlich die Kosten einer akzeptierten Einstellung, nicht nur die Kosten eines Modelldurchlaufs.

| Modell und Generierungsdienst | Basistarif | 5 Sekunden | 10 Sekunden | 30 Sekunden Material |
| --- | ---: | ---: | ---: | ---: |
| H3 Max Turbo, 768p — fal, Aktion | 0,02 USD/s | 0,38 PLN | 0,76 PLN | 2,28 PLN |
| H3 Max Turbo, 1080p — fal, Aktion | 0,04 USD/s | 0,76 PLN | 1,52 PLN | 4,56 PLN |
| H3 Max Turbo, 768p — Magnific Premium+, Jahresabo | 200 Credits / 5 s | 0,47 PLN | 0,94 PLN | 2,83 PLN |

Stand: **18. September 2026**. Die fal-Aktion endet am 30. September 2026; laut veröffentlichter Preisliste sollen sich die Tarife danach verdoppeln. Die Magnific-Werte setzen voraus, dass das gesamte Jahreskontingent von 600.000 Credits genutzt wird.

Die Beschreibung kann Bild, Kamera und Ton verbinden, sofern der gewählte Modus diese Elemente unterstützt. Lege bei mehreren aufeinanderfolgenden Handlungen fest, was zuerst geschieht, was danach folgt und wie die Einstellung endet.

Das Beispiel setzt ein Startbild voraus, auf dem eine Verpackung und eine Tasse auf einer Arbeitsplatte stehen:

```text
One continuous shot based on the starting image. The camera is
initially stationary, and the coffee package stays fixed throughout.

A hand enters from the right and gently rotates the cup on the table
until its handle points toward the camera. The hand releases the cup
and leaves the frame.

The camera then slowly moves forward toward the package, keeping
the front label in view. It gradually slows to a stop and holds
a close-up for the end of the shot.

Audio: quiet indoor ambience and a soft scraping sound as the base
of the cup moves across the table.
```

Die Tasse bleibt beim Drehen auf der Arbeitsplatte, die Hand beendet ihre Handlung vor der Heranfahrt und die Kamera hält am Ende an. Du musst nicht sämtliche Farben und Gegenstände auf dem Foto erneut beschreiben.

Englisch ist in diesem Leitfaden die Arbeitssprache. Das ist kein Ergebnis eines Tests, der die Wirksamkeit verschiedener Sprachen in H3 Max Turbo vergleicht.

### Prüfe die automatische Prompt-Erweiterung

Das API-Schema von fal beschreibt den Parameter `prompt_expansion_mode` mit den Einstellungen `balanced`, `quality` und `disabled`. Letztere schaltet die Erweiterung aus. Die Antwort kann auch den überarbeiteten Text enthalten. [Quelle: fal — H3 Max Turbo, text-to-video](https://fal.ai/models/minimax/h3-max-turbo/text-to-video/api).

Bei einer groben Idee kann die Erweiterung Teil deines Workflows sein. Bei einem genauen Ablauf lohnt sich ein Vergleich mit ausgeschalteter Überarbeitung, sofern die Plattform diese Einstellung anbietet. Beurteile dann nicht nur den eingegebenen Text, sondern prüfe auch, ob er vor der Generierung erweitert wurde.

Übernimm Hailuos Befehle in Klammern nicht ohne bestätigte Unterstützung in H3 Max. Auch im hier beschriebenen Basisschema von H3 Max Turbo ist kein separates Feld `negative_prompt` aufgeführt. [Quelle: fal — H3 Max Turbo, text-to-video](https://fal.ai/models/minimax/h3-max-turbo/text-to-video/api).

#### Start-Prompt für ChatGPT — H3 Max Turbo

```text
Hilf mir, Prompts für MiniMax H3 Max Turbo zu schreiben. Antworte auf Deutsch und erstelle fertige Prompts auf Englisch. Generiere keine Videos.

Prüfe zunächst die verfügbare Dokumentation:
https://fal.ai/minimax-h3-max
https://fal.ai/models/minimax/h3-max-turbo/text-to-video/api
https://platform.minimax.io/docs/guides/video-generation

Unterscheide H3, H3 Max, H3 Max Turbo und Hailuo. Fasse die Regeln für das gewählte Modell zusammen. Sobald ich die Plattform nenne, prüfe die Funktionen ihrer Integration. Kennzeichne nicht bestätigte Angaben.

Falls ich die Einstellung noch nicht beschrieben habe, frage nach Beschreibung, Plattform, Dauer, Seitenverhältnis, Materialien und gewünschtem Ton. Frage nur nach fehlenden Angaben. Erstelle den Prompt direkt, sobald die Beschreibung vollständig ist.

Beschreibe Handlung und Kamerabewegung in natürlichen Sätzen. Lege bei mehreren Handlungen Reihenfolge und Abschluss fest. Konzentriere dich bei der Animation eines ersten Bildes auf Veränderungen, statt die gesamte Fotobeschreibung zu wiederholen.

Ordne Geräusche konkreten Ereignissen und Dialoge bestimmten Personen zu. Bewahre Wortlaut und Sprache der Äußerungen und prüfe die Sprachunterstützung. Ergänze keine nicht angeforderten Handlungen, Schnitte oder Effekte.

Prüfe prompt_expansion_mode und erläutere die verfügbaren Einstellungen außerhalb des Prompts. Übernimm nicht automatisch Kamerabefehle aus Hailuo. Berücksichtige negativen Prompt und zusätzliche Referenzeingaben nur, wenn der konkrete Modus sie unterstützt.

Gib einen Prompt in einem Codeblock und die Einstellungen auf Deutsch aus. Trenne dokumentierte Empfehlungen von eigenen Vorschlägen. Nutze für weitere Einstellungen die bereits vereinbarte Konfiguration.
```

---

## 19. Wan 3.0

### Nutze die Anleitung zur richtigen Version

Die unten verlinkten Materialien von fal beschreiben die Generierung aus Text, Bildern und Referenzen. Genannt werden auch automatische Prompt-Erweiterung und zusätzliche Planung vor der Generierung. [Quelle: fal — Wan 3](https://fal.ai/wan-3).

Das bedeutet nicht, dass du Einstellungen und lange Negativlisten aus lokalen Wan-2.x-Konfigurationen ungeprüft übernehmen kannst. Nutze die Dokumentation des konkreten Wan-3.0-Modus.

Englisch ist hier die Arbeitssprache. Diese Konvention bedeutet nicht, dass das Modell auf Englisch immer besser funktioniert als auf Chinesisch oder in einer anderen Sprache.

### Beschreibe die Szene und ihren Ablauf

Beginne bei Text-to-Video mit dem Ort und der Anordnung der Gegenstände. Lege anschließend Bewegung und abschließenden Bildausschnitt fest.

```text
A close-up product shot in a small, sunlit kitchen. A coffee package
stands beside a ceramic cup on the counter.

The package is slightly to the right of center in the opening frame.
The camera tracks slowly to the right, parallel to the counter,
with a fixed viewing direction. The move ends with the package near
the center of the frame and its front label fully visible.

Steam rises gently from the cup while the package remains stationary.

Audio: quiet kitchen ambience and the faint sound of a kettle
in the background.
```

Ausgangsposition des Produkts und Bewegungsrichtung hängen zusammen. Die Beschreibung verlangt nicht gleichzeitig eine unveränderte Blickrichtung und ein während der gesamten Fahrt stets mittig platziertes Produkt.

Weise jedem Referenzmaterial eine klare Rolle zu. Das Wan-3.0-Schema beschreibt Verweise auf Bilder und Videos anhand ihrer Position in der Eingabeliste. Nutze die Markierungen dieser Integration, statt automatisch die aus Seedance bekannten Tags zu übernehmen. [Quelle: fal — Wan 3.0, reference-to-video](https://fal.ai/models/alibaba/wan-3.0/reference-to-video/api).

```text
Use the first reference image for the coffee package's shape,
colors, and label design.

Use the first reference video only for the camera movement.
Place the package in a new, bright kitchen setting rather than
recreating the background from the reference video.
```

### Stelle Parameter außerhalb des Prompts ein

In der beschriebenen Integration sind `enable_thinking` und `enable_prompt_expansion` separate Einstellungen. „Think carefully“ in die Szenenbeschreibung zu schreiben, ist nicht gleichbedeutend mit einer Änderung ihrer Werte.

Lege bei einer geplanten Werbeeinstellung Dauer und Seitenverhältnis fest, statt sie der Automatik zu überlassen. So lassen sich aufeinanderfolgende Tests leichter vergleichen.

Im hier beschriebenen Basisschema für Text-to-Video ist kein separates Feld `negative_prompt` aufgeführt. Schreibe die Anforderungen an das Aussehen des Produkts daher in die Hauptbeschreibung, ohne einen nicht unterstützten Parameter hinzuzufügen. [Quelle: fal — Wan 3.0, text-to-video](https://fal.ai/models/alibaba/wan-3.0/text-to-video/api).

#### Start-Prompt für ChatGPT — Wan 3.0

```text
Hilf mir, Prompts für Wan 3.0 vorzubereiten. Gib Erklärungen auf Deutsch und fertige Prompts auf Englisch aus. Generiere keine Videos.

Prüfe zunächst die verfügbare Dokumentation:
https://fal.ai/wan-3
https://fal.ai/models/alibaba/wan-3.0/text-to-video/api
https://fal.ai/models/alibaba/wan-3.0/reference-to-video/api

Fasse die Regeln für Version 3.0 kurz zusammen. Sobald du die Plattform kennst, prüfe die Funktionen des gewählten Modus. Übernimm nicht automatisch Parameter aus Wan 2.x. Kennzeichne nicht bestätigte Angaben.

Falls ich die Szene noch nicht beschrieben habe, frage nach Beschreibung, Plattform, Dauer, Seitenverhältnis, Materialien und gewünschtem Ton. Frage nur nach fehlenden Informationen. Erstelle den Prompt direkt, sobald die Beschreibung vollständig ist.

Beschreibe bei Text-to-Video das Aussehen der Szene und die Bewegung. Konzentriere dich bei Image-to-Video auf die Animation. Weise Referenzen konkrete Aufgaben zu und nutze die von der Integration unterstützten Markierungen. Kopiere keine Tags anderer Modelle.

Trenne Kamera- von Objektbewegungen. Prüfe, ob Ausgangsposition, Bewegungsrichtung und abschließender Bildausschnitt zusammenpassen. Beschreibe aufeinanderfolgende Handlungen in logischer Reihenfolge.

Beschreibe den Ton separat und passend zum Bild. Ordne Dialog einer Person zu, bewahre Wortlaut und Sprache und prüfe die Sprachunterstützung.

Erläutere enable_thinking und enable_prompt_expansion auf Deutsch außerhalb des Prompts. Ersetze diese Einstellungen nicht durch Befehle in der Szenenbeschreibung. Ergänze einen negativen Prompt nur nach bestätigter Verfügbarkeit dieses Feldes.

Gib den fertigen Prompt in einem Codeblock und die Einstellungen auf Deutsch aus. Nutze für weitere Einstellungen die bereits vereinbarte Konfiguration.
```

---

## Wie beschreibst du eine Einstellung in der nächsten Nachricht an ChatGPT?

Du musst die Fachbegriffe für Kamerabewegungen nicht kennen. Beschreibe in Alltagssprache, was passieren soll. Wichtig ist, Kamerabewegung und Objektverhalten zu trennen und den Zweck des Anhangs zu erklären.

Beispielnachricht nach der Modellauswahl:

```text
Plattform: Higgsfield.
Modell: das zuvor in diesem Gespräch ausgewählte.
Dauer: 10 Sekunden. Falls der Modus diese Dauer nicht unterstützt, nenne die verfügbaren Möglichkeiten.
Seitenverhältnis: Hochformat 9:16.

Das angehängte Foto soll das erste Bild des Videos sein, nicht nur eine Referenz für das Aussehen des Produkts.

Ich möchte eine ruhige Werbeeinstellung. Die Kamera soll sich langsam geradlinig nach rechts bewegen und dem Produkt dabei leicht nähern. Gemeint ist weder eine Kreisfahrt um das Produkt noch ein Zoom.

Das Produkt soll die ganze Zeit an derselben Stelle stehen und sich nicht drehen. Die Vorderseite der Verpackung soll sichtbar bleiben. Am Ende brauche ich etwas freien Raum über dem Produkt, weil ich später in Premiere Text einfüge.

Kein Dialog. Den Ton füge ich beim Schnitt selbst hinzu. Bewahre Umgebung und Beleuchtung des Fotos. Füge keine neuen Personen oder Gegenstände hinzu.

Am wichtigsten sind das unveränderte Aussehen des Produkts und eine flüssige Kamerabewegung. Falls der vorgeschlagene Bildausschnitt dem Foto widerspricht, benenne das Problem, statt das Konzept selbst zu ändern.
```

Das *Seitenverhältnis* beziehungsweise *Aspect Ratio* beschreibt das Verhältnis von Bildbreite zu Bildhöhe. 9:16 steht für ein Hochformat, nicht für eine bestimmte Pixelzahl. Wähle die Auflösung separat aus den Einstellungen der Plattform.

In deiner Nachricht an ChatGPT kannst du deutsche Verbote wie „Das Produkt darf sich nicht drehen“ verwenden. Das ist eine Aufgabenbeschreibung, kein fertiger Generator-Prompt. Der Chat sollte die Absicht in modellgerechte Formulierungen übertragen, etwa „The package remains stationary“ bei Runway.

## Wie verbesserst du einen Prompt nach einer misslungenen Generierung?

Schreibe nicht nur „Mach es besser“, sondern benenne den Unterschied zwischen Absicht und Ergebnis. Am hilfreichsten ist Feedback, das Objekt, Fehlerart und Zeitpunkt des Problems nennt.

Allgemein:

> Es wirkt künstlich.

Konkret:

> Die Kamera ist einen Bogen gefahren, obwohl sie sich geradlinig zur Seite bewegen sollte. Ab der dritten Sekunde wird die Verpackung breiter. Die Bewegung des Dampfes sieht gut aus; ändere die entsprechende Anweisung nicht.

Korrigiere jeweils nur eine Problemkategorie. So lässt sich leichter beurteilen, ob die Prompt-Änderung tatsächlich geholfen hat.

| Problem | Was du prüfen oder ändern solltest |
| --- | --- |
| Das Produkt dreht sich statt der Kamera | Beschreibe das unbewegte Produkt und die gewünschte Kamerabewegung getrennt. |
| Unerwünschte Schnitte treten auf | Prüfe den Multi-Shot-Modus und Formulierungen, die einen Wechsel zur nächsten Einstellung nahelegen. |
| Das Aussehen des Produkts verändert sich | Prüfe die Qualität des Ausgangsmaterials, die Rolle der Referenzen und den Bewegungsumfang. Ein längerer Prompt allein behebt die Ursache nicht. |
| Eine Person führt Handlungen in falscher Reihenfolge aus | Ordne die Handlungen und lege fest, in welchem Zustand die Szene nach jeder Handlung bleibt. |
| Die falsche Person spricht den Dialog | Verwende einheitliche Personenbezeichnungen und ordne jede Äußerung einzeln zu. |
| Das Ergebnis weicht von einer präzisen Beschreibung ab | Prüfe, ob die Plattform den Prompt automatisch erweitert oder umschreibt, und berücksichtige dies beim Vergleich der Tests. |

Das schrittweise Verfeinern der Anweisungen entspricht dem von Runway beschriebenen Ansatz. Bei den besprochenen MiniMax- und Wan-Integrationen können auch Einstellungen relevant sein, die den Prompt vor der Generierung verändern. [Quellen: Runway — Gen-4-Leitfaden](https://help.runwayml.com/hc/en-us/articles/39789879462419-Gen-4-Video-Prompting-Guide), [MiniMax — image-to-video](https://platform.minimax.io/docs/api-reference/video-generation-i2v), [fal — Wan 3.0, text-to-video](https://fal.ai/models/alibaba/wan-3.0/text-to-video/api).

### Was klärt die Dokumentation nicht?

Dieser Leitfaden verweist auf besonders ausführliche Materialien zu Runway, Veo, Kling und Seedance 2.5. Ein ähnlich umfassendes, eigenständiges Prompt-Handbuch für Seedance 2.0 Mini wird nicht vorgestellt. Die Bezeichnung „Seedance 2 Pro“ muss auf der jeweiligen Plattform eingeordnet werden. Ebenso fehlen vergleichbare Studien, die eine einzige beste Prompt-Sprache für alle besprochenen Modelle bestimmen würden.

Statt dir ein Universalrezept wie „immer 150 Wörter, immer Englisch, immer eine lange Negativliste“ zu merken, dokumentiere die Konfiguration erfolgreicher Tests: Modell, Plattform, Modus, Materialien, Prompt und Einstellungen. Für die nächste Einstellung hast du dann einen konkreten Vergleichspunkt statt einer allgemeinen Regel, die möglicherweise nicht zum Werkzeug passt.

---

*Redaktioneller Hinweis: Sprache, Satzbau, Konsistenz der Anweisungen und Logik der Beispielszenen wurden überarbeitet. Angaben zu Modellfunktionen und Verweise wurden aus dem bereitgestellten Artikel übernommen. Diese Überarbeitung umfasst weder eine erneute Prüfung der Dokumentation noch Tests der Generatoren.*
