# Comment rédiger des prompts pour les générateurs vidéo IA

Un guide pratique pour Seedance, Kling, Veo, Runway, Hailuo, H3 Max et Wan, avec des exemples et des instructions prêtes à l’emploi pour ChatGPT.

Imaginez un plan publicitaire simple : un paquet de café sur un plan de travail, une tasse fumante à côté, et une caméra qui s’approche lentement du produit. Avant de décrire cette scène au générateur, définissez votre point de départ. Avez-vous déjà une photo à animer ? Le modèle doit-il créer la cuisine à partir d’un texte ? Doit-il reproduire l’emballage à partir d’une autre photo ? Le film a-t-il besoin de son ?

Ces décisions déterminent le contenu du prompt, c’est-à-dire l’instruction transmise au générateur. Le modèle choisi compte aussi. La documentation de Runway Gen-4 recommande de décrire le résultat souhaité plutôt que d’ajouter des interdictions. Veo dispose d’un champ documenté pour les instructions négatives, tandis que MiniMax décrit des commandes de caméra spécifiques à Hailuo. Mieux vaut donc éviter de copier le même modèle de prompt détaillé dans tous les outils. [Sources : Runway — guide Gen-4](https://help.runwayml.com/hc/en-us/articles/39789879462419-Gen-4-Video-Prompting-Guide), [Google — guide Veo](https://cloud.google.com/vertex-ai/generative-ai/docs/video/video-gen-prompt-guide), [MiniMax — image-to-video](https://platform.minimax.io/docs/api-reference/video-generation-i2v).

Ce guide comprend 19 chapitres consacrés aux différents modèles et à leurs variantes. Les exemples proposent des façons de rédiger les prompts ; ils ne sont pas issus d’un test comparatif. Une instruction peut définir précisément le résultat attendu, sans garantir que le générateur le reproduira sans erreur.

## Avant de choisir les instructions pour votre modèle

### Dans quelle langue écrire ?

Les exemples de prompts de ce guide sont en anglais, ce qui permet de reprendre la terminologie de la documentation et du travail de caméra. Cela ne signifie pas que l’anglais donne toujours de meilleurs résultats que le polonais ou d’autres langues.

La documentation Google annonce une prise en charge complète de l’anglais dans Veo. Pour les autres familles, considérez l’anglais comme la langue de travail retenue ici, et non comme le meilleur choix démontré par des études. [Source : Google — génération vidéo dans l’API Gemini](https://ai.google.dev/gemini-api/docs/veo).

Distinguez trois éléments :

| Élément | Comment le décrire |
| --- | --- |
| Instruction au générateur | Vous pouvez décrire la scène, l’action et la caméra en anglais. |
| Réplique d’un personnage | Indiquez son texte exact et sa langue. Vérifiez que le modèle prend en charge la génération de parole dans cette langue. |
| Texte visible dans le film | Conservez le texte original. Prévoyez de préférence les slogans importants ou les prix sur une couche distincte ajoutée au montage. |

La langue du prompt et celle du dialogue sont deux choses différentes. Les guides de Kling 2.6 et 3.0 décrivent une traduction automatique vers l’anglais des répliques dans les langues non prises en charge. Insérer une phrase polonaise dans le prompt ne garantit donc pas un dialogue en polonais. [Sources : Kling 2.6 — audio](https://kling.ai/quickstart/klingai-video-26-audio-user-guide), [Kling 3.0 — guide du modèle](https://kling.ai/quickstart/klingai-video-3-model-user-guide).

### Définissez d’abord le rôle des sources

**Text-to-video : une vidéo à partir de texte.** Le modèle crée à la fois l’apparence de la scène et son déroulement. Décrivez donc le lieu, le sujet principal, l’action, la lumière et la caméra.

**Image-to-video : l’animation d’une image de départ.** La photo constitue la première image du film, ou *start frame*. Elle définit la composition initiale. Dans le prompt, concentrez-vous surtout sur le mouvement et sur ce qui doit rester inchangé.

**Génération à partir de références.** Une photo ou une vidéo sert de modèle pour un produit, un personnage, un style ou un mouvement. Elle n’est pas nécessairement la première image. Précisez les caractéristiques que le modèle doit en reprendre.

**Modification d’un film existant.** Le point de départ est une vidéo déjà réalisée. Indiquez l’élément à modifier, le résultat attendu et ce qui doit être conservé.

Toutes les plateformes ne proposent pas tous les modes d’une famille de modèles. Le nom du modèle et celui de la plateforme sont donc deux informations distinctes. [Sources : Runway — image-to-video](https://help.runwayml.com/hc/en-us/articles/48324313115155), [Kling — Omni](https://kling.ai/quickstart/klingai-video-3-omni-model-user-guide).

### Comment utiliser les instructions prêtes à l’emploi pour ChatGPT ?

Les blocs intitulés **« Prompt de départ pour ChatGPT »** servent à préparer la conversation avec le chat. Ne les collez pas directement dans le générateur vidéo.

Choisissez d’abord les instructions pour votre modèle et envoyez-les à ChatGPT. Le chat doit consulter les sources indiquées, résumer les principes essentiels et demander les informations manquantes. Décrivez ensuite le plan et joignez une photo ou d’autres sources. Vous recevrez un prompt en anglais pour le générateur, ainsi que les réglages séparés : durée, rapport d’aspect et son, notamment.

Si vous fournissez immédiatement la description du plan et toutes les informations nécessaires, il n’y a aucune raison d’attendre un autre message. Pour la suite, le chat doit aussi mémoriser le modèle et la plateforme choisis, au lieu de les redemander à chaque photo.

Ces instructions supposent un accès à la recherche sur Internet. Si le chat ne peut pas lire la documentation, il doit distinguer clairement les informations vérifiées de celles qui restent à confirmer. [Source : OpenAI — ChatGPT Search](https://help.openai.com/en/articles/9237897-chatgpt-search).

**Ces instructions servent uniquement à préparer du texte. Elles ne demandent pas de lancer une génération d’images ou de vidéos.**

---

## 1. Seedance 2.5

### Comment structurer le prompt

Un prompt pour Seedance 2.5 peut se concevoir comme une courte note de réalisation. Définissez le résultat, attribuez un rôle aux sources jointes, puis décrivez l’action et la caméra. Le guide aborde aussi les références, les étapes temporelles, le son et la modification d’une vidéo existante. [Source : fal — guide Seedance 2.5](https://fal.ai/learn/devs/how-to-use-seedance-2-5).

Voici un ordre utile :

> Type de plan → rôle des sources → déroulement de l’action → mouvement de caméra → son → éléments à conserver.

Il s’agit d’une façon d’organiser les informations, pas d’une syntaxe obligatoire. Si trois phrases précises suffisent à animer une photo, inutile d’en faire un scénario complet.

#### Attribuez un rôle précis à chaque référence

Si deux photos montrent le même emballage sous des angles différents, dites-le explicitement. Pour une photo d’intérieur supplémentaire, précisez si elle doit définir l’ensemble du décor ou seulement la direction de la lumière.

```text
The first two reference images show the same coffee package from
different angles. Use them as references for the package's shape,
colors, and label design.

Use the third reference image for the kitchen setting and the
direction of the window light.
```

Le guide de l’intégration fal emploie des repères comme `@Image1`. Utilisez-les uniquement si l’interface choisie les prend en charge. Écrire un nom de fichier ou un repère ne remplace pas l’ajout de la source dans le champ approprié. [Source : fal — prompting Seedance 2.5](https://fal.ai/learn/devs/seedance-2-5-prompting-guide).

#### Décrivez les actions dans un ordre logique

Une formule vague comme « une femme soulève une tasse, publicité dynamique » laisse beaucoup de décisions au modèle. Si vous souhaitez un déroulement précis, détaillez-le :

> Une main droite entre par le bord droit du cadre, saisit la tasse par l’anse et la soulève au-dessus du plan de travail. Après un bref instant, elle la repose au même endroit, lâche l’anse et sort du cadre.

Chaque action doit découler de la précédente. La tasse ne peut pas être à la fois posée sur le plan de travail et tenue dans la main. Si elle doit revenir à sa position initiale, décrivez le geste de la reposer puis de lâcher l’anse.

#### Détaillez le timing lorsque l’ordre compte

L’exemple ci-dessous suppose une image de départ montrant l’emballage et une tasse dont l’anse est accessible depuis la droite. Il nécessite aussi un mode capable de produire un clip de 12 secondes.

```text
One continuous shot based on the starting image. The coffee package
remains stationary throughout.

0–3 seconds: a right hand enters from the right edge of the frame
and gently grasps the cup by its handle.

3–8 seconds: the hand lifts the cup a few centimeters above the table
and holds it steady. The camera slowly moves forward toward the
package, keeping the front label fully in view.

8–12 seconds: the hand lowers the cup to its original position,
releases the handle, and leaves the frame. The camera gradually
slows to a stop, holding a close view of the package.

Audio: quiet room ambience and a soft tap as the cup is
set back on the table.
```

Les repères temporels indiquent le déroulement souhaité. Ils ne garantissent pas une exécution de chaque action à l’image près. Adaptez le nombre d’actions à la durée du film. [Source : fal — guide Seedance 2.5](https://fal.ai/learn/devs/how-to-use-seedance-2-5).

### Langue, son et limites

Les instructions destinées au générateur sont en anglais dans ce guide. Rédigez toutefois les dialogues dans la langue où ils doivent être prononcés et attribuez-les à un personnage précis. Vérifiez séparément la prise en charge de cette langue.

La documentation décrit aussi une notation facultative pour le son et les sous-titres : parenthèses pour la musique, chevrons pour les effets, accolades pour les dialogues et `〖〗` pour les sous-titres. Il n’est pas nécessaire de l’utiliser dans chaque prompt. Une description simple reliant le son à une action visible constitue un point de départ clair. [Source : fal — guide Seedance 2.5](https://fal.ai/learn/devs/how-to-use-seedance-2-5).

La consigne « conserver la disposition de l’étiquette » n’équivaut pas à un champ `negative_prompt` distinct. Sa disponibilité dépend de l’intégration. Pour modifier une vidéo, choisissez un seul enregistrement de base et décrivez la portée du changement, plutôt que d’attribuer à plusieurs fichiers le rôle de source principale. [Source : Dreamina — guide Seedance 2.5](https://dreamina.capcut.com/seedance/seedance-2-5-prompt).

#### Prompt de départ pour ChatGPT — Seedance 2.5

```text
Aide-moi à préparer des prompts pour Seedance 2.5. Réponds en français et rédige les prompts destinés au générateur en anglais. Ne lance aucune génération d’images ou de vidéos.

Commence par consulter la documentation disponible :
https://fal.ai/learn/devs/how-to-use-seedance-2-5
https://fal.ai/learn/devs/seedance-2-5-prompting-guide
https://dreamina.capcut.com/seedance/seedance-2-5-prompt

Résume brièvement les principes utiles à la rédaction des prompts. Si tu ne peux pas lire une source, précise ce qui n’a pas pu être confirmé. Lorsque je donnerai la plateforme, vérifie aussi les fonctions de son intégration particulière.

Si je n’ai pas encore décrit le plan, demande sa description, la plateforme, la durée, le rapport d’aspect et les sources. Ne demande que les informations manquantes. Si la description et les pièces jointes sont déjà fournies, commence le travail. N’invente pas de scène d’exemple avant que je présente mon idée.

Identifie s’il s’agit de text-to-video, de l’animation d’une première image, de références ou de la modification d’une vidéo. Attribue un rôle précis à chaque fichier joint. Utilise les repères pris en charge par la plateforme.

Respecte mon idée. Décris les actions dans un ordre logique, distingue les mouvements de caméra de ceux des objets et précise la fin du plan. Pour animer une photo, concentre-toi sur les changements sans répéter tout son contenu. Ne détaille le timing que si nécessaire.

Conserve les dialogues dans la langue que j’indique. Si le modèle ne la prend pas en charge, explique la limite au lieu de traduire le texte de ta propre initiative. Associe les sons à des événements précis.

Fournis un seul prompt prêt à l’emploi dans un bloc de code. Indique en dessous, en français, les réglages disponibles sur la plateforme. Prépare un prompt négatif distinct uniquement si le mode choisi le permet. Ne mentionne que les limites pertinentes pour ce plan.

Pour les plans suivants, réutilise les réglages déjà fournis, sauf si je les modifie. Ne redemande pas les informations que tu possèdes déjà.
```

---

## 2. Seedance 2.0 et le nom « Seedance 2 Pro »

### Identifiez d’abord le modèle choisi

Le nom affiché sur une plateforme ne suffit pas toujours à identifier la version du modèle. Magnific répertorie Seedance 2.0, Seedance 2.0 Fast et Seedance 2.0 Mini. Les sources citées ici ne décrivent pas de règles de rédaction distinctes pour le nom « Seedance 2 Pro ». Rien ne justifie donc de lui attribuer une syntaxe propre. Reliez d’abord ce nom à une variante précise du service. [Source : Magnific — Seedance 2](https://www.magnific.com/seedance-2).

### Comment écrire pour Seedance 2.0

La documentation Runway décrit la génération à partir de texte, l’utilisation de références ainsi que des première et dernière images. Le prompt doit correspondre au mode choisi. [Source : Runway — Seedance 2.0](https://help.runwayml.com/hc/en-us/articles/50488490233363-Creating-with-Seedance-2-0).

En **text-to-video**, décrivez d’abord l’apparence de la scène, puis le mouvement :

```text
A simple product commercial in a bright kitchen. A matte coffee
package stands on a pale wooden table, with a white ceramic cup
slightly behind it.

The camera tracks slowly to the right, parallel to the edge of the
table. The package remains fully in frame, with its front label
visible. The camera movement creates gentle parallax between the
package and the kitchen background.

Steam rises slowly from the cup. Soft daylight enters from the left.
The package remains upright and stationary throughout the shot.
```

En **image-to-video**, la photo définit déjà l’apparence de la scène initiale. Vous pouvez donc raccourcir la description :

```text
The camera tracks slowly to the right, parallel to the table edge.
The coffee package remains upright and stationary, with its front
label visible throughout. Steam rises gently from the cup.
The lighting remains consistent with the starting image.
```

Avec des **références**, précisez ce qui doit être repris de chaque fichier. Une vidéo peut servir uniquement de référence pour le mouvement de caméra, et non pour le décor. Une photo peut définir l’apparence du produit sans imposer sa position dans le nouveau cadre.

Avec une **première et une dernière image**, décrivez une transition logique entre les deux. Si la dernière montre un plan plus large que la première, demander une avancée continue vers le produit peut être contradictoire. [Source : Runway — Seedance 2.0](https://help.runwayml.com/hc/en-us/articles/50488490233363-Creating-with-Seedance-2-0).

### Langue et instructions négatives

L’anglais reste la langue de travail retenue ici. Ne transposez toutefois pas automatiquement la notation audio de Seedance 2.5 à la version 2.0. Commencez par une description simple et consultez la documentation de l’intégration choisie.

Procédez de même pour les instructions négatives. Définissez d’abord le résultat attendu, puis rédigez un *prompt négatif* distinct décrivant les éléments indésirables uniquement si la plateforme propose le champ correspondant.

#### Prompt de départ pour ChatGPT — Seedance 2.0

```text
Aide-moi à rédiger des prompts pour Seedance 2.0. Donne les explications en français et les prompts finaux en anglais. Ne lance pas de génération vidéo.

Vérifie d’abord la documentation disponible :
https://seed.bytedance.com/en/seedance2_0
https://help.runwayml.com/hc/en-us/articles/50488490233363-Creating-with-Seedance-2-0
https://fal.ai/seedance-2.0

Résume les principes essentiels. Distingue les fonctions du modèle de celles de la plateforme. N’attribue pas à la version 2.0 des fonctions de Seedance 2.5 sans confirmation. Si une source est illisible, précise ce qui reste incertain.

Si je n’ai pas encore décrit le plan, demande sa description, la plateforme, la durée, le rapport d’aspect et les sources. Ne demande que les données manquantes. Consulte la documentation de la plateforme dès que tu connais son nom.

Prépare un prompt cohérent à partir de ma description. Pour le text-to-video, définis l’apparence et le déroulement de la scène. Pour animer une photo, concentre-toi sur le mouvement. Attribue un rôle précis aux références. Avec une première et une dernière image, décris une transition compatible avec les deux.

Écris des phrases naturelles. Distingue les mouvements de caméra et des objets. N’ajoute pas de personnages, de coupes ou d’effets non demandés. Conserve les marques, les textes affichés et la langue des dialogues. Si la langue parlée n’est pas prise en charge, explique-le plutôt que de traduire de ta propre initiative.

Fournis le prompt dans un bloc de code, puis les réglages séparément en français. N’ajoute un prompt négatif que pour un mode qui le permet. Conserve les réglages convenus pour les plans suivants jusqu’à ce que je les modifie.
```

#### Prompt de départ pour ChatGPT — modèle nommé « Seedance 2 Pro » sur la plateforme

```text
Sur ma plateforme, le modèle s’appelle « Seedance 2 Pro ». Aide-moi à identifier la version correspondant à ce nom, puis à préparer des prompts pour elle. Ne génère ni images ni vidéos.

Si je n’ai pas nommé la plateforme, demande son nom ou une capture des réglages. Vérifie ensuite la documentation de l’intégration. Tu peux commencer par ces sources :
https://www.magnific.com/seedance/seedance-2
https://www.magnific.com/ai/docs/video-ai-models
https://seed.bytedance.com/en/seedance2_0

Ne considère pas Pro, Standard, Fast et Mini comme des noms interchangeables. Si l’identification reste incertaine, indique ce qui n’a pas pu être établi. Dans ce cas, utilise uniquement les principes confirmés de la famille Seedance 2.0 et ne donne pas de paramètres non vérifiés.

Une fois le modèle identifié, demande les informations manquantes du plan : description, durée, rapport d’aspect et sources. Si je les ai déjà fournies, prépare le prompt sans nouvelle série de questions.

Rédige les explications en français et le prompt du générateur en anglais. Adapte-le au text-to-video, à l’animation d’une première image ou aux références. Décris l’action, la caméra et les éléments à conserver.

Préserve la langue des dialogues et le texte des inscriptions. Vérifie leur prise en charge pour la variante concernée. N’ajoute un prompt négatif que si un champ adapté existe. Fournis le texte final dans un bloc de code et les réglages en dessous.

Pour les plans suivants, conserve le modèle et la plateforme établis jusqu’à ce que je demande un changement.
```

---

## 3. Seedance 2.0 Fast

### Comment tester la variante Fast

La documentation présente Seedance 2.0 Fast comme une variante de la même famille, avec ses propres réglages. Cela n’implique pas de devoir employer une autre structure de phrase ou un langage particulier. [Source : fal — Seedance 2.0](https://fal.ai/seedance-2.0).

Limitez le nombre de variables au premier essai. Testez d’abord le mouvement de caméra, puis ajoutez celui du décor et enfin une interaction avec un objet. Si le résultat se dégrade après une modification précise, la cause sera plus facile à identifier. C’est une méthode de test, pas une affirmation selon laquelle Fast serait réservé aux scènes simples.

Exemple pour une photo produit :

```text
One continuous shot based on the starting image. The camera slowly
moves forward toward the coffee package. The package stays fixed
on the table, with its front label visible throughout.

A small amount of steam rises from the cup behind it.
The soft window light remains constant.
```

À l’essai suivant, vous pouvez ajouter une main qui soulève la tasse. Ne changez pas en même temps la lumière, le fond et la direction de la caméra, sinon vous saurez difficilement quelle modification a influencé le résultat.

### Langue et réglages

Les exemples sont en anglais. Réglez séparément la durée, le rapport d’aspect et la génération audio, selon les possibilités de la plateforme.

Le schéma d’API indiqué ci-dessous ne comporte pas de champ `negative_prompt` distinct pour le mode Fast décrit. N’ajoutez pas ce paramètre en vous fondant sur les instructions d’un autre générateur. [Source : fal — Seedance 2.0 Fast, text-to-video](https://fal.ai/models/bytedance/seedance-2.0/fast/text-to-video/api).

#### Prompt de départ pour ChatGPT — Seedance 2.0 Fast

```text
Aide-moi à préparer des prompts pour Seedance 2.0 Fast. Réponds en français et rédige les prompts finaux en anglais. Ne génère pas de vidéos.

Vérifie d’abord la documentation disponible :
https://fal.ai/seedance-2.0
https://fal.ai/models/bytedance/seedance-2.0/fast/text-to-video/api
https://help.runwayml.com/hc/en-us/articles/50488490233363-Creating-with-Seedance-2-0

Présente brièvement les principes essentiels. Vérifie les fonctions de ma plateforme lorsque je donnerai son nom. Ne suppose pas que Fast possède les mêmes réglages que les autres variantes. Signale clairement toute source inaccessible.

Si je n’ai pas décrit le plan, demande la description, la plateforme, la durée, le rapport d’aspect et les sources. Ne redemande pas les informations connues. Dès que les données suffisent, prépare le prompt.

Respecte l’idée principale et décris les événements dans un ordre logique. Sépare les mouvements de caméra de ceux des objets. Pour animer une photo, concentre-toi sur les changements. Attribue des rôles précis aux références. N’ajoute pas d’actions ou d’effets de ta propre initiative.

Conserve les marques, les textes affichés et la langue des dialogues. Vérifie la prise en charge de la parole si le plan en nécessite. Prépare un prompt négatif uniquement si le mode choisi le permet.

Fournis un prompt dans un bloc de code. Indique séparément la durée, le rapport d’aspect, la résolution et le son, dans les limites des options proposées par la plateforme. Pour les plans suivants, garde la configuration déjà établie.
```

---

## 4. Seedance 2.0 Mini

### Commencez par un plan facile à évaluer

Seedance 2.0 Mini figure dans les catalogues de Runway et de Magnific. Les sources citées ici ne proposent toutefois pas de guide de rédaction dédié aussi détaillé pour cette variante. Les conseils suivants décrivent donc une méthode de test, et non des limites supplémentaires de Mini. [Sources : Runway — catalogue des modèles](https://docs.dev.runwayml.com/guides/models/), [Magnific — Seedance 2](https://www.magnific.com/seedance-2).

Commencez par une seule tâche : la caméra se déplace latéralement, le produit reste immobile et l’éclairage ne change pas. Réservez l’ouverture de l’emballage, les dialogues et les changements de décor à des essais distincts.

Pour comparer Mini à la version complète de Seedance 2.0, utilisez la même image et un prompt aussi identique que possible. Sinon, vous évaluez à la fois le modèle et les différences de description.

```text
The camera tracks slowly to the right, parallel to the table edge.
The coffee package remains stationary and fully in frame.
The camera movement creates gentle parallax between the package
and the background.

The package's shape, label design, and soft daylight remain
consistent with the starting image.
```

L’anglais est ici la langue de travail. N’appliquez pas automatiquement à Mini les règles d’anciens modèles nommés « Lite ». Vérifiez la prise en charge des références, du son et de la dernière image pour l’intégration concernée.

#### Prompt de départ pour ChatGPT — Seedance 2.0 Mini

```text
Aide-moi à rédiger des prompts pour Seedance 2.0 Mini. Donne les explications en français et les prompts finaux en anglais. Ne génère pas de vidéos.

Vérifie d’abord les informations disponibles :
https://docs.dev.runwayml.com/guides/models/
https://www.magnific.com/seedance/seedance-2
https://help.runwayml.com/hc/en-us/articles/50488490233363-Creating-with-Seedance-2-0

Distingue les principes communs à Seedance 2.0 des informations propres à Mini. Ne lui attribue pas les fonctions de Lite ou de 2.5. Si la documentation ne tranche pas un point, signale-le.

Si je n’ai pas décrit le plan, demande sa description, la plateforme, la durée, le rapport d’aspect et les sources. Ne demande que les informations manquantes. Une fois la plateforme connue, vérifie les fonctions de son intégration.

Prépare un seul prompt conforme à mon idée. Précise clairement l’action, la direction et la vitesse de la caméra, ainsi que les éléments immobiles. Pour animer une photo, ne répète pas toute sa description visuelle. Ne te réfère qu’aux sources réellement jointes.

Si les actions sont trop nombreuses pour la durée du clip, signale le problème et propose d’en réduire le nombre. Préserve les textes et la langue des dialogues ; vérifie séparément la prise en charge de la parole.

Fournis le prompt final dans un bloc de code et les réglages en français. N’indique un prompt négatif et des paramètres supplémentaires qu’après confirmation de leur disponibilité. Garde les réglages convenus pour les plans suivants.
```

---

## 5. Kling 2.5 / Kling 2.5 Turbo

### Décrivez séparément les mouvements de caméra et des objets

Dans l’intégration fal décrite ici, le nom complet du modèle contient « 2.5 Turbo », avec des mentions supplémentaires indiquant la variante de qualité. Vérifiez le nom complet avant de choisir les réglages. [Source : fal — Kling 2.5 Turbo Standard](https://fal.ai/models/fal-ai/kling-video/v2.5-turbo/standard/image-to-video).

Le guide text-to-video de Kling propose de décrire le sujet ou le personnage principal, l’action et l’environnement, puis de préciser la caméra et la lumière. En image-to-video, le mouvement compte davantage, puisque la photo définit déjà l’apparence des éléments. [Source : Kling — guide text-to-video](https://kling.ai/quickstart/text-to-video-prompt-guide).

Si la photo montre un emballage, une tasse et un rideau, vous pouvez écrire :

```text
The camera tracks slowly to the right, parallel to the table edge.
The coffee package remains upright and stationary, with its front
label visible throughout.

Steam rises gently from the cup behind the package. The curtain
in the background sways slightly in a light breeze.
```

Chaque phrase concerne un élément précis. Une correction n’impose donc pas de réécrire tout le prompt. Si la photo ne montre pas de rideau, n’ajoutez pas cette phrase simplement parce qu’elle figure dans l’exemple.

Distinguez bien « l’emballage tourne » de « la caméra décrit un arc autour de l’emballage immobile ». Dans le premier cas, le produit change de position ; dans le second, c’est la caméra qui bouge. Pour garder l’étiquette visible en permanence, décrivez un petit arc, pas un tour complet du produit.

### Instructions négatives et langue

Les exemples sont en anglais. Un *prompt négatif* distinct peut contenir une courte liste d’erreurs pertinentes pour le plan, à condition que le mode choisi propose ce champ.

Ce champ est disponible dans l’API Kling 2.5 Turbo Standard décrite ici. Exemple :

```text
duplicate packages, distorted packaging, altered label design,
flickering lighting, sudden camera shake
```

Le même schéma décrit le paramètre `cfg_scale`. Gardez d’abord la valeur par défaut. Pour évaluer son influence, modifiez-le en conservant le même prompt et la même source. La valeur maximale ne doit pas être considérée comme automatiquement optimale. [Source : fal — Kling 2.5 Turbo Standard, API](https://fal.ai/models/fal-ai/kling-video/v2.5-turbo/standard/image-to-video/api).

#### Prompt de départ pour ChatGPT — Kling 2.5 Turbo

```text
Aide-moi à préparer des prompts pour Kling 2.5 Turbo. Réponds en français et rédige les prompts du générateur en anglais. Ne génère pas de vidéo.

Vérifie d’abord la documentation disponible :
https://kling.ai/quickstart/text-to-video-prompt-guide
https://kling.ai/quickstart/image-to-video-guide
https://fal.ai/models/fal-ai/kling-video/v2.5-turbo/standard/image-to-video/api

Résume brièvement les principes. Une fois la plateforme connue, vérifie la variante Standard ou Pro disponible et ses réglages. Utilise la documentation de cette variante. Signale tout point non confirmé.

Si je n’ai pas décrit le plan, demande sa description, la plateforme, la durée, le rapport d’aspect et les sources. Ne demande que les informations manquantes.

Prépare un prompt à partir de ma description. En text-to-video, décris le sujet principal, l’action, l’environnement et la caméra. En image-to-video, concentre-toi sur l’animation des éléments visibles.

Sépare clairement le mouvement de caméra de celui du produit. Précise la direction, la vitesse et l’amplitude. N’ajoute pas de coupes ou d’effets non demandés. Pour une orbite, adapte son amplitude à la partie du produit qui doit rester visible.

Si l’intégration accepte un prompt négatif, prépare séparément une courte liste des changements indésirables. N’exclus pas les textes ou les logos à conserver dans l’image. Préserve les marques et le texte des étiquettes.

Fournis le prompt dans un bloc de code, le prompt négatif éventuel dans un second bloc et les réglages en français. N’ajoute ni repères ni pondérations de mots non documentés. Conserve la configuration établie pour les plans suivants.
```

---

## 6. Kling 2.6 Pro

### Pensez l’image et le son comme une seule scène

Le guide Kling 2.6 décrit la génération audio native. Il recommande de définir la scène, l’action et ce qui doit être entendu. Pour les dialogues, précisez la personne qui parle, les paroles exactes et la manière de les prononcer. [Source : Kling 2.6 — guide audio](https://kling.ai/quickstart/klingai-video-26-audio-user-guide).

Un prompt clair peut séparer l’image et le son, mais les deux parties doivent décrire le même événement. Si l’on doit entendre la tasse être reposée, incluez aussi ce geste dans la description visuelle.

```text
A barista stands behind a small café counter, holding a white cup.
The camera starts in a medium shot and slowly moves closer as the
barista places the cup beside the coffee package.

After setting down the cup, the barista looks toward the customer
and says in a relaxed tone, in English:
"Good morning. Your coffee is ready."

Audio: a soft tap as the cup touches the counter, followed by the
barista's voice. Quiet café ambience continues in the background.
```

C’est la caméra qui bouge, pas le « plan moyen ». La valeur de plan définit le cadrage. L’exemple précise aussi quand le personnage repose la tasse, quand il commence à parler et à qui il s’adresse.

Avec deux interlocuteurs, utilisez des désignations constantes, par exemple « the barista » et « the customer ». Le pronom « she » peut être ambigu si deux femmes sont présentes. Pour le premier essai, prévoyez des répliques successives, sans chevauchement des voix.

### Attention à la langue des dialogues

La documentation mentionne la parole en chinois et en anglais, ainsi que la traduction des autres langues vers l’anglais. Ne prévoyez donc pas une publicité polonaise avec un dialogue natif en polonais sans vérifier l’intégration actuelle. Si la langue n’est pas prise en charge, une voix off enregistrée ou générée séparément constitue une alternative. [Source : Kling 2.6 — guide audio](https://kling.ai/quickstart/klingai-video-26-audio-user-guide).

Décrire la scène en anglais n’oblige pas à écrire les répliques anglaises EN MAJUSCULES. Utilisez une orthographe normale, en gardant les majuscules nécessaires, notamment pour les noms et les sigles. [Source : fal — Kling 2.6 Pro, text-to-video](https://fal.ai/models/fal-ai/kling-video/v2.6/pro/text-to-video/api).

Si la plateforme permet d’attribuer une voix enregistrée à un personnage, utilisez l’identifiant réel de cette voix. Un exemple comme `@VoiceName` ne crée pas une nouvelle voix et ne fonctionne pas sans configuration adaptée.

#### Prompt de départ pour ChatGPT — Kling 2.6 Pro

```text
Aide-moi à rédiger des prompts pour Kling 2.6 Pro. Donne les explications en français et les prompts finaux en anglais. Ne lance pas de génération vidéo.

Vérifie d’abord la documentation disponible :
https://kling.ai/quickstart/klingai-video-26-audio-user-guide
https://fal.ai/models/fal-ai/kling-video/v2.6/pro/text-to-video/api

Résume les principes concernant l’image, le son et les langues parlées. Une fois la plateforme connue, vérifie les fonctions du mode précis, dont l’audio et le prompt négatif. Signale les informations non confirmées.

Si je n’ai pas décrit le plan, demande sa description, la plateforme, la durée, le rapport d’aspect, les sources et le dialogue éventuel. Ne demande que les éléments manquants. Si la description est complète, prépare immédiatement le prompt.

Sépare l’image du son dans le prompt, tout en les gardant cohérents. Associe chaque effet sonore à un événement précis. Attribue chaque réplique à un personnage, avec son ton et son débit. Évalue si les dialogues et les actions tiennent dans la durée du clip.

Pour animer une photo, concentre-toi sur le mouvement. Distingue le cadrage du déplacement de la caméra. N’ajoute pas de personnages ou d’objets non demandés.

Conserve la langue et le texte exact des dialogues. Si la parole en polonais n’est pas prise en charge ou confirmée, explique-le et propose une piste de voix off séparée. Ne traduis pas les répliques de ta propre initiative. Utilise seulement les identifiants réels des voix disponibles sur ma plateforme.

Fournis le prompt dans un bloc de code et les réglages en français, y compris l’audio. N’ajoute un prompt négatif que pour un mode qui le permet. Réutilise les informations établies pour les plans suivants.
```

---

## 7. Kling 3.0 / Kling 3.0 Pro

### Choisissez : un seul plan ou plusieurs

Le guide Kling 3.0 décrit le mode Multi-Shot, qui permet de planifier une séquence avec des changements de plan. Il mentionne aussi les références d’éléments liées à l’image de départ. [Source : Kling 3.0 — guide du modèle](https://kling.ai/quickstart/klingai-video-3-model-user-guide).

Avant d’écrire, choisissez entre un plan continu et une courte séquence. Pour un travelling avant fluide sans coupe, vous pouvez commencer ainsi :

```text
One continuous shot.
```

N’ajoutez pas ensuite « cut to a close-up », qui demande une coupe vers un autre plan. Vérifiez aussi que les réglages de la plateforme correspondent à la réalisation souhaitée.

Exemple d’une séquence de trois plans :

```text
Shot 1 — 4 seconds:
A medium shot of a coffee package and a cup on a kitchen table.
A hand enters from the right, gently turns the cup until its handle
points to the right, releases it, and leaves the frame.

Shot 2 — 4 seconds:
Cut to a close-up of the same package in the unchanged setting.
The camera slowly moves closer, keeping the front label in view.
The cup remains in the position established in the first shot.

Shot 3 — 4 seconds:
Cut to a wider, static view of the same tabletop arrangement.
Keep the package in the lower half of the frame, with clear space
above it for a title to be added during editing.
```

Ce découpage suppose une durée de 12 secondes et un mode compatible. La main termine son geste et sort du cadre avant la première coupe, tandis que la tasse reste à sa nouvelle place. Le modèle n’a donc pas à deviner ce que sont devenus ces éléments lors des transitions.

### Conservez les mêmes références de personnages et de produits

Si la plateforme permet d’enregistrer un produit ou un personnage comme élément de référence, réutilisez ce même élément dans tous les plans. Une longue description ne remplace pas une référence correctement associée.

Si une voix précise est déjà attribuée au personnage, ne lui donnez pas des caractéristiques contradictoires dans le plan suivant. Le guide Kling signale ce type de conflit. [Source : Kling 3.0 — guide du modèle](https://kling.ai/quickstart/klingai-video-3-model-user-guide).

### Langue et variante Pro

Les exemples sont en anglais. Pour la parole générée, le guide cite le chinois, l’anglais, le japonais, le coréen et l’espagnol. Le polonais ne figure pas dans la liste ; les autres langues sont décrites comme étant traduites vers l’anglais. [Source : Kling 3.0 — guide du modèle](https://kling.ai/quickstart/klingai-video-3-model-user-guide).

La mention Pro n’implique pas à elle seule un autre style de prompt. Vérifiez les paramètres et fonctions qu’elle désigne chez le fournisseur concerné. [Source : Artlist — famille Kling 3](https://help.artlist.io/hc/en-us/articles/37026869403933-Kling-3-Model-Family).

#### Prompt de départ pour ChatGPT — Kling 3.0 / Pro

```text
Aide-moi à préparer des prompts pour Kling 3.0 ou Kling 3.0 Pro. Réponds en français et rédige le texte du générateur en anglais. Ne génère ni images ni vidéos.

Vérifie d’abord la documentation disponible :
https://kling.ai/quickstart/klingai-video-3-model-user-guide
https://help.artlist.io/hc/en-us/articles/37026869403933-Kling-3-Model-Family

Présente brièvement les principes essentiels. Une fois ma plateforme connue, vérifie la variante, Multi-Shot, les références d’éléments, l’audio et le prompt négatif. Indique les points non confirmés.

Si je n’ai pas décrit le plan, demande sa description, la plateforme, la durée, le rapport d’aspect et les sources. Ne demande que les informations manquantes.

Détermine à partir de ma description s’il faut un plan continu ou une séquence. Ne combine pas une consigne sans coupe avec des instructions de coupe. Pour une séquence, prépare des descriptions et des durées distinctes adaptées au mode. Assure la continuité des positions des objets et des actions des personnages entre les plans.

Pour animer une première image, concentre-toi sur le mouvement. Utilise seulement les références réellement jointes et les noms d’éléments existants.

Attribue chaque réplique à un personnage. Préserve son texte exact et sa langue et vérifie leur prise en charge. Ne remplace pas une voix déjà associée à une référence et ne traduis pas les répliques sans demande.

Fournis le prompt final ou les descriptions des plans dans des blocs de code. Indique les réglages séparément en français. N’ajoute des champs que si l’intégration les accepte. Pour la suite, conserve le modèle, la plateforme et les références établis.
```

---

## 8. Kling 3.0 Turbo

### Vérifiez d’abord le mode et le format d’entrée

Le schéma de l’API Kling 3.0 Turbo Pro text-to-video décrit soit un `prompt` unique, soit une structure `multi_prompt` avec des descriptions et des durées distinctes par plan. Ce sont deux méthodes alternatives, pas deux champs à remplir simultanément. [Source : fal — Kling 3.0 Turbo Pro, API](https://fal.ai/models/fal-ai/kling-video/v3/turbo/pro/text-to-video/api).

Dans une interface graphique, choisissez d’abord le bon mode. Si la plateforme propose des champs de storyboard distincts, écrire « Shot 1, Shot 2 » dans le champ texte habituel ne remplace pas leur utilisation.

Dans la documentation API, consultez la **section Input du mode choisi**. La page peut aussi contenir des définitions de types utilisées ailleurs. La présence de `negative_prompt` ou `generate_audio` plus bas ne signifie pas forcément que ce mode accepte ces paramètres. [Source : fal — Kling 3.0 Turbo Pro, API](https://fal.ai/models/fal-ai/kling-video/v3/turbo/pro/text-to-video/api).

### Décrivez la direction, la vitesse et l’amplitude du mouvement

Les sources citées ici ne décrivent pas de syntaxe propre à Turbo. Vous pouvez partir des mêmes phrases précises que pour Kling 3.0.

```text
One continuous product shot. The camera moves slowly to the right
along a small arc around the stationary coffee package, keeping
approximately the same distance from it.

The camera remains aimed at the package. Its front label stays
visible throughout, while the changing viewpoint creates gentle
parallax in the background.
```

Cette description indique un mouvement en arc. Ne l’utilisez pas pour un déplacement latéral rectiligne. Précisez la vitesse dans le prompt : le nom de la variante ne la définit pas.

L’anglais reste la langue de travail. Vérifiez les dialogues, les références et les paramètres supplémentaires pour le mode choisi, plutôt que de reprendre les réglages du Kling 3.0 standard.

#### Prompt de départ pour ChatGPT — Kling 3.0 Turbo

```text
Aide-moi à rédiger des prompts pour Kling 3.0 Turbo. Donne les explications en français et les prompts finaux en anglais. Ne génère pas de vidéos.

Vérifie d’abord la documentation disponible :
https://fal.ai/models/fal-ai/kling-video/v3/turbo/pro/text-to-video/api
https://console.higgsfield.ai/models/kling-video/v3.0-turbo/text-to-video/playground
https://kling.ai/quickstart/klingai-video-3-model-user-guide

Résume les principes propres à cette variante. Une fois la plateforme connue, vérifie le mode précis et sa section Input. Ne considère pas les paramètres d’autres modèles comme disponibles dans Turbo. Signale explicitement les incertitudes liées au manque de documentation.

Si je n’ai pas décrit le plan, demande sa description, la plateforme, la durée, le rapport d’aspect et les sources. Ne redemande pas les informations connues.

Pour un plan unique, prépare un prompt cohérent. Pour une séquence, détaille les plans et leurs durées dans le format exigé par la plateforme. Traite prompt et multi_prompt comme deux méthodes alternatives, pas comme des champs à remplir ensemble.

Définis précisément la direction, la vitesse et l’amplitude de la caméra. Distingue le déplacement latéral, l’arc, la rotation de la caméra et le changement de focale. Décris le mouvement du produit séparément. Préserve mon idée sans ajouter de coupes, de personnages ou d’effets.

Conserve la langue du dialogue et vérifie la parole pour le mode choisi. N’inclus l’audio, les références et le prompt négatif que si cette intégration les propose.

Fournis le texte final dans un bloc de code et les réglages en français. Garde la configuration précédemment établie pour les plans suivants.
```

---

## 9. Kling O3 / Kling 3.0 Omni

### Pour une modification, décrivez le changement, pas toute la scène

Distinguez Kling O3 de Kling 3.0 standard. Le guide Omni traite des références, des éléments, de la voix et du storyboard, et renvoie aussi à la documentation O1 pour la modification vidéo. [Source : Kling — guide 3.0 Omni](https://kling.ai/quickstart/klingai-video-3-omni-model-user-guide).

Créer une nouvelle scène demande de décrire ce qui doit apparaître. Pour modifier une vidéo existante, l’essentiel est la consigne de changement :

> Remplace la tasse de la vidéo par celle de la photo de référence. Conserve le déroulement de l’action, la caméra et l’environnement.

Ce n’est pas la même situation que la description d’un nouveau plan dans Runway Gen-4. Ici, l’instruction directe « remplace » vise un objet précis dans une vidéo de base.

Exemple de modification d’une vidéo où une main soulève une tasse puis la repose sur le plan de travail :

```text
Replace the cup in the input video with the cup shown in the reference
image. Use the image only as a reference for the replacement cup,
not for the surrounding scene.

Keep the original hand movement, camera movement, tabletop, lighting,
and timing. Match the replacement cup to the original cup's position
and orientation throughout the shot.

Keep the fingers naturally wrapped around the handle, with correct
overlap between the hand and the cup. When the cup rests on the table,
maintain natural contact with the surface and a matching contact shadow.
```

Le dernier paragraphe définit la relation entre la main, l’anse et le plan de travail. Il ne demande pas des occultations identiques pour deux objets de formes potentiellement différentes, mais précise le contact naturel attendu.

### Précisez l’étendue de la modification et le rôle de chaque fichier

Choisissez une seule vidéo de base. Indiquez l’objet à modifier, éventuellement le passage concerné et le résultat. Si vous remplacez seulement l’emballage, ne redécrivez pas la cuisine, les vêtements et la lumière.

Une photo de référence peut servir uniquement pour le produit. Précisez-le afin de ne pas suggérer la reprise de tout l’arrière-plan.

Le guide de modification décrit notamment le remplacement d’éléments, le changement de décor et de style et l’utilisation d’un mouvement de référence. Il ne garantit pas pour autant la conservation de chaque pixel hors de l’objet modifié. [Source : Kling — guide O1](https://kling.ai/quickstart/klingai-video-o1-user-guide).

Préparez le prompt en anglais. Vérifiez l’audio séparément pour la génération et la modification : sa présence dans un mode ne confirme pas son fonctionnement dans l’autre.

#### Prompt de départ pour ChatGPT — Kling O3

```text
Aide-moi à préparer des prompts pour Kling O3 / Kling 3.0 Omni. Réponds en français et rédige le texte final du générateur en anglais. Ne lance aucune génération d’images ou de vidéos.

Vérifie d’abord la documentation disponible :
https://kling.ai/quickstart/klingai-video-3-omni-model-user-guide
https://kling.ai/quickstart/klingai-video-o1-user-guide
https://help.artlist.io/hc/en-us/articles/37026869403933-Kling-3-Model-Family

Résume brièvement les principes. Une fois la plateforme connue, vérifie les possibilités du mode précis. Si les sources sont indisponibles ou ne tranchent pas un point, précise l’incertitude.

Si je n’ai pas décrit la tâche, demande sa description, la plateforme, les sources et les réglages vidéo nécessaires. Ne demande que les données manquantes.

Distingue la création d’une scène, les références et la modification vidéo. Pour une modification, identifie la vidéo de base, l’objet ciblé, la portée du changement et les éléments à conserver. Ne reconstruis pas toute la scène si je demande de remplacer un seul objet.

Attribue un rôle précis à chaque référence. Utilise uniquement les pièces jointes réelles et les repères compatibles avec la plateforme. Tiens compte de la position de l’objet, du contact avec les mains et les surfaces, des occultations, des ombres et de la continuité du mouvement.

Présente la conservation des éléments non modifiés comme une exigence, pas comme une garantie d’identité pixel par pixel. Vérifie l’audio et le prompt négatif pour le mode choisi, pas seulement pour toute la famille. Préserve la langue des dialogues et vérifie sa prise en charge.

Fournis un prompt dans un bloc de code et les réglages en français. Pour les tâches suivantes, garde les données établies, sauf si je change de modèle, de plateforme ou de méthode.
```

---

## 10. Veo 3.1

### Séparez la description de l’image de celle du son

Pour Veo, le choix de l’anglais s’appuie sur la documentation Google, qui annonce sa prise en charge complète. Il ne faut toutefois pas confondre la langue des instructions avec la prise en charge de toutes les langues de dialogue. [Source : Google — Veo dans l’API Gemini](https://ai.google.dev/gemini-api/docs/veo).

Pour une génération à partir de texte, définissez le sujet principal, le décor, l’action, la caméra et la lumière. Décrivez le son séparément, en le rattachant à la même scène.

```text
A close-up product shot of a coffee package beside a white cup
and saucer on a pale wooden table in a quiet kitchen.

The camera slowly moves forward toward the package. Steam rises
gently from the cup. Soft morning light enters from the left.

A hand enters from the right, places a teaspoon on the saucer,
and leaves the frame. The package remains stationary.

Audio: quiet kitchen ambience, the faint sound of a kettle in the
background, and a light clink as the metal teaspoon touches the
ceramic saucer.
```

Dans cet exemple, la soucoupe et la main figurent dans la description visuelle, et pas seulement dans l’instruction audio. Le son est associé au contact de la cuillère avec la soucoupe.

Pour animer une photo, raccourcissez la description de l’apparence. Google recommande une image d’entrée de qualité et d’éviter d’en répéter inutilement le contenu. N’utilisez l’exemple de la cuillère que s’il correspond à la photo et à l’action souhaitée. [Source : Google Cloud — bonnes pratiques de génération vidéo](https://docs.cloud.google.com/gemini-enterprise-agent-platform/models/video/best-practice).

#### Dialogues

Précisez la personne qui parle, les paroles exactes, la langue et le ton. La longueur du texte doit correspondre à la durée du clip.

```text
The barista looks toward the customer and says warmly, in English:
"Take a moment. Your coffee is ready."
```

Pour un dialogue en polonais, vérifiez l’intégration choisie et faites un essai avant de prévoir une production plus importante. La prise en charge annoncée des prompts anglais ne garantit pas une génération fiable de parole en polonais.

### Prompt négatif

Le guide Google recommande d’énumérer les éléments indésirables sans les formulations « no » et « don't ». Cette liste va dans un champ distinct, si la plateforme en propose un. [Source : Google Cloud — guide de prompting Veo](https://cloud.google.com/vertex-ai/generative-ai/docs/video/video-gen-prompt-guide).

```text
duplicate products, distorted packaging, altered label design,
flickering exposure, sudden camera shake
```

N’indiquez pas simplement « text » si l’étiquette du produit doit rester visible. La liste doit exclure des erreurs précises, pas les éléments nécessaires à la publicité.

### Références, première et dernière image

Une photo produit utilisée comme référence n’est pas nécessairement l’image de départ. En mode référence, précisez les caractéristiques à reprendre. Avec une première et une dernière image, décrivez le déroulement qui les relie.

La documentation Google décrit aussi l’extension de vidéos, mais les fonctions disponibles dépendent de la variante. Ne supposez pas que Lite dispose de toutes ces possibilités. [Source : Google — Veo dans l’API Gemini](https://ai.google.dev/gemini-api/docs/veo).

#### Prompt de départ pour ChatGPT — Veo 3.1

```text
Aide-moi à rédiger des prompts pour Veo 3.1. Réponds en français et prépare les prompts finaux en anglais. Ne génère pas de vidéo.

Vérifie d’abord la documentation disponible :
https://ai.google.dev/gemini-api/docs/veo
https://cloud.google.com/vertex-ai/generative-ai/docs/video/video-gen-prompt-guide
https://docs.cloud.google.com/gemini-enterprise-agent-platform/models/video/best-practice

Présente brièvement les principes concernant l’image, le son et les références. Une fois la plateforme connue, vérifie les modes et réglages disponibles. Signale les informations non confirmées.

Si je n’ai pas décrit le plan, demande sa description, la plateforme, la durée, le rapport d’aspect, les sources et le son souhaité. Ne demande que les données manquantes. Si la description est complète, prépare immédiatement le prompt.

En text-to-video, définis l’apparence, l’action, la caméra et la lumière. En image-to-video, concentre-toi sur le mouvement. Distingue photo de référence, première image et dernière image et attribue-leur les bons rôles.

Décris le son séparément, mais en cohérence avec l’image. Si une action doit être entendue, inclus-la dans le déroulement visuel. Attribue chaque réplique à un personnage en conservant ses mots et sa langue. Vérifie la prise en charge de la langue plutôt que de traduire de ta propre initiative.

Si l’intégration offre un prompt négatif, prépare une courte liste d’éléments indésirables sans « no » ni « don't ». N’exclus pas les étiquettes, textes et logos à conserver.

Fournis le prompt et l’éventuel prompt négatif dans des blocs de code séparés. Indique les réglages en français, selon la durée et le mode disponibles. Garde la configuration établie pour les plans suivants.
```

---

## 11. Veo 3.1 Fast

### Gardez les mêmes principes, mais vérifiez les réglages de la variante

La documentation Google ne définit pas de syntaxe distincte pour Fast. Le point de départ reste la scène, la caméra, le son et, si nécessaire, un prompt négatif. Vérifiez les réglages disponibles pour la variante précise. [Source : Google — Veo dans l’API Gemini](https://ai.google.dev/gemini-api/docs/veo).

Pour le premier test, choisissez un résultat facile à évaluer : par exemple, la caméra s’approche tandis que le produit reste immobile.

```text
One continuous shot based on the starting image. The camera slowly
moves forward toward the coffee package, keeping its front label
fully in view. The package remains fixed on the table.
Steam rises gently from the cup.

Audio: quiet indoor ambience.
```

Pour comparer Fast à une autre variante, conservez le prompt et les sources. Ne considérez toutefois pas ce changement comme une augmentation de résolution du film existant. Il s’agit d’une nouvelle génération, dont le déroulement peut différer.

Rédigez les instructions en anglais, conformément au choix de langue retenu pour la famille Veo. [Source : Google — Veo dans l’API Gemini](https://ai.google.dev/gemini-api/docs/veo).

#### Prompt de départ pour ChatGPT — Veo 3.1 Fast

```text
Aide-moi à préparer des prompts pour Veo 3.1 Fast. Rédige les explications en français et le texte du générateur en anglais. Ne génère pas de vidéos.

Vérifie d’abord la documentation disponible :
https://ai.google.dev/gemini-api/docs/veo
https://cloud.google.com/vertex-ai/generative-ai/docs/video/video-gen-prompt-guide

Résume les principes essentiels. Une fois la plateforme connue, vérifie les réglages de Fast. Ne lui attribue pas de limites ni de syntaxe particulière non confirmées par la documentation. Signale les lacunes des sources.

Si je n’ai pas décrit le plan, demande sa description, la plateforme, la durée, le rapport d’aspect, les sources et le son souhaité. Ne demande que les informations manquantes. Dès qu’elles suffisent, prépare le prompt.

Respecte mon idée. Pour animer une photo, concentre-toi sur les mouvements de caméra, des objets et du décor. Adapte le nombre d’actions à la durée. N’ajoute pas de coupes ou de nouveaux éléments de ta propre initiative.

Décris le son séparément, en accord avec l’image. Attribue le dialogue à un personnage précis, garde ses mots et sa langue et vérifie la parole. Ne traduis pas les répliques sans demande.

N’ajoute un prompt négatif que dans un mode compatible, sous forme de liste sans « no » ni « don't ». Ne présente pas un changement de variante comme un moyen de reproduire à l’identique une vidéo précédente en meilleure qualité.

Fournis le prompt dans un bloc de code et les réglages en français. Réutilise les données établies pour les plans suivants.
```

---

## 12. Veo 3.1 Lite

### Adaptez l’idée aux entrées disponibles

Selon la documentation Gemini API indiquée ci-dessous, Lite prend en charge la génération à partir de texte et d’image ainsi que les première et dernière images. Il ne prend pas en charge l’entrée `referenceImages`, l’extension d’une vidéo existante ni la génération 4K. Vérifiez que ces informations restent valables pour le mode choisi avant la production. [Source : Google — Veo dans l’API Gemini](https://ai.google.dev/gemini-api/docs/veo).

Énumérer plusieurs noms de photos dans le prompt ne remplace pas une entrée de références absente. Pour animer une composition produit précise, préparez une image de départ adaptée et décrivez son mouvement.

L’exemple suivant suppose une photo produit prise avec une caméra placée légèrement au-dessus de son centre :

```text
The camera slowly lowers to the height of the package's front label,
keeping the same horizontal distance from the product. It adjusts
its tilt smoothly so that the package remains in frame, ending
with the label centered in the image.

The package and cup remain stationary. Steam rises gently from
the cup, and the lighting stays consistent with the starting image.
```

La description distingue l’abaissement de la caméra du changement de son orientation. Une formule vague comme « la caméra descend vers le produit » ne précise pas s’il s’agit d’une descente verticale, d’une inclinaison ou d’un travelling avant en diagonale.

Ajoutez la dernière image dans le champ prévu, si la plateforme le propose. La phrase « end frame: attached image » n’associe pas automatiquement une pièce jointe ordinaire à cette fonction.

L’anglais reste la langue de travail. Les scènes courtes sont pratiques pour tester, mais ne constituent pas en elles-mêmes une exigence documentée de Lite.

#### Prompt de départ pour ChatGPT — Veo 3.1 Lite

```text
Aide-moi à rédiger des prompts pour Veo 3.1 Lite. Réponds en français et rédige les prompts finaux en anglais. Ne lance pas de génération vidéo.

Vérifie d’abord la documentation disponible :
https://ai.google.dev/gemini-api/docs/veo
https://cloud.google.com/vertex-ai/generative-ai/docs/video/video-gen-prompt-guide

Vérifie les informations propres à Lite. Une fois la plateforme connue, contrôle aussi les fonctions de son intégration. N’attribue pas à Lite des références, l’extension vidéo ou des résolutions simplement parce qu’une autre variante Veo les prend en charge. Signale les informations non confirmées.

Si je n’ai pas décrit le plan, demande sa description, la plateforme, la durée, le rapport d’aspect et les sources. Ne demande que les données manquantes.

Prépare un prompt adapté à la génération à partir de texte ou à l’animation d’image. N’utilise les première et dernière images que si le mode le permet. Ne considère pas une photo comme transmise au modèle si elle n’est pas jointe à la bonne entrée.

Décris clairement l’action et la caméra. Distingue le changement de position de la rotation ou de l’inclinaison. Relie le son à l’image. Préserve la langue du dialogue et vérifie sa prise en charge. N’ajoute un prompt négatif qu’après confirmation du champ approprié.

Fournis le prompt dans un bloc de code et les réglages en français. Si l’idée nécessite une fonction absente, explique le problème et propose la solution réalisable la plus proche. Garde les réglages convenus pour les plans suivants.
```

---

## 13. Runway Gen-4.5

### Privilégiez une description précise plutôt qu’un prompt long

Le guide Runway souligne qu’il n’existe ni formule obligatoire ni nombre de mots idéal. Des phrases naturelles aident à décrire les relations entre les éléments. L’ordre d’énumération des caractéristiques n’est pas un système de pondération documenté. [Source : Runway — guide text-to-video](https://help.runwayml.com/hc/en-us/articles/42460036199443-Text-to-Video-Prompting-Guide).

En **text-to-video**, décrivez l’apparence et le mouvement. En **image-to-video**, la photo définit la composition, la lumière et le style de départ ; le prompt doit se concentrer sur ce qui va se passer. [Source : Runway — Gen-4.5](https://help.runwayml.com/hc/en-us/articles/46974685288467-Creating-with-Gen-4-5).

Exemple pour une photographie de produit :

```text
The camera moves slowly forward and slightly to the right along
a straight diagonal path. The coffee package stays fixed on the
table, with its front label visible throughout.

Steam rises gently from the cup. Near the end of the shot, the camera
gradually slows to a stop and holds a close-up of the package.
```

La description indique que la caméra se déplace en ligne droite, sans arc. La fin est aussi définie : le mouvement ralentit jusqu’à l’arrêt, puis le cadre reste fixe. Après le premier essai, vous pouvez modifier la distance parcourue ou la taille du produit dans la dernière image.

### Vous pouvez décrire les étapes successives

Il n’est pas nécessaire de réduire chaque scène à une seule action. La documentation Gen-4.5 aborde les enchaînements naturels d’actions et les repères temporels approximatifs. [Source : Runway — guide image-to-video](https://help.runwayml.com/hc/en-us/articles/48324313115155).

L’exemple suivant suppose une tasse au premier plan et un emballage derrière :

```text
The camera remains stationary. The cup in the foreground is in focus,
while the coffee package behind it is softly out of focus.

A hand enters from the right, grasps the cup by its handle, and lifts
it out of the frame. As the cup leaves, focus shifts smoothly to the
coffee package, bringing its front label into sharp focus.
```

Le changement de mise au point n’est pas mêlé à un mouvement de caméra indéfini. On sait d’abord ce qui est net, puis ce qui quitte le premier plan, et enfin quel objet devient net. Cet enchaînement doit toujours tenir dans la durée du clip.

### Vérifiez que le mouvement est compatible avec la photo

Le flou de mouvement, une silhouette penchée ou la disposition des objets peuvent suggérer une direction. Si le prompt demande l’inverse, l’image et l’instruction se contredisent. Runway attire l’attention sur ces indices visuels. [Source : Runway — guide image-to-video](https://help.runwayml.com/hc/en-us/articles/48324313115155).

Les exemples utilisent l’anglais et des formulations positives du résultat attendu. N’ajoutez pas de prompt négatif distinct sans confirmer la disponibilité du champ. Prévoyez le son séparément plutôt que de supposer sa prise en charge par le modèle d’animation.

#### Prompt de départ pour ChatGPT — Runway Gen-4.5

```text
Aide-moi à préparer des prompts pour Runway Gen-4.5. Donne les explications en français et les prompts finaux en anglais. Ne génère pas de vidéos.

Vérifie d’abord la documentation disponible :
https://help.runwayml.com/hc/en-us/articles/46974685288467-Creating-with-Gen-4-5
https://help.runwayml.com/hc/en-us/articles/42460036199443-Text-to-Video-Prompting-Guide
https://help.runwayml.com/hc/en-us/articles/48324313115155-Image-to-Video-Prompting-Guide

Résume brièvement les principes. Une fois la plateforme connue, vérifie les modes et réglages disponibles. Signale les informations non confirmées.

Si je n’ai pas décrit le plan, demande sa description, la plateforme, la durée, le rapport d’aspect et une éventuelle photo. Ne demande que les données manquantes.

Prépare un prompt conforme à mon idée. En text-to-video, décris l’apparence et le mouvement. En image-to-video, concentre-toi sur l’animation, la caméra, la direction et la vitesse sans répéter tout le contenu de la photo.

Écris des phrases naturelles et précises. N’impose pas de limite artificielle de mots et ne traite pas l’ordre des termes comme une pondération. Décris les étapes et les durées approximatives seulement si elles éclairent le déroulement. Vérifie que les actions tiennent dans le clip.

Distingue le mouvement de caméra, le changement de mise au point et le mouvement du sujet. Vérifie la cohérence avec l’image d’entrée. Utilise des descriptions positives du résultat plutôt que de longues interdictions. N’ajoute pas de prompt négatif ni de fonction audio non confirmés.

Fournis le prompt dans un bloc de code et les réglages en français. En cas de contradiction, explique-la brièvement et propose une correction. Réutilise les réglages convenus pour les plans suivants.
```

---

## 14. Runway Gen-4 Turbo

### Partez de l’image initiale

Dans le processus décrit par Runway, Gen-4 Turbo nécessite une image d’entrée. Une description textuelle seule ne remplace pas une première image absente. [Source : Runway — catalogue des modèles](https://docs.dev.runwayml.com/guides/models/).

Le guide Gen-4 recommande de partir d’une instruction simple et d’ajouter progressivement les détails nécessaires. Décrivez les mouvements du sujet, de la caméra et du décor. [Source : Runway — guide Gen-4](https://help.runwayml.com/hc/en-us/articles/39789879462419-Gen-4-Video-Prompting-Guide).

```text
The camera slowly moves forward toward the coffee package.
The package and cup remain stationary. Steam rises gently from
the cup, while the package's front label stays visible throughout.
```

Si le travelling avant fonctionne comme prévu, ajoutez éventuellement un léger déplacement latéral. Combiner d’emblée orbite, zoom, changement de mise au point et mouvement du produit rend plus difficile l’identification de la consigne problématique.

### Décrivez le résultat souhaité plutôt que des interdictions

Runway déconseille explicitement les formulations négatives pour Gen-4. Au lieu de « no camera movement », utilisez :

```text
The camera remains stationary.
```

Au lieu de « the package must not move », écrivez :

```text
The package remains stationary.
```

Ces deux phrases définissent clairement l’état souhaité. Une longue liste comme « no blur, no deformation, no extra objects » n’est pas un substitut recommandé à une description précise du plan. [Source : Runway — guide Gen-4](https://help.runwayml.com/hc/en-us/articles/39789879462419-Gen-4-Video-Prompting-Guide).

L’anglais reste la langue de travail. Si une génération échoue, vérifiez l’image de départ et la cohérence du mouvement avant d’allonger le prompt.

#### Prompt de départ pour ChatGPT — Runway Gen-4 Turbo

```text
Aide-moi à rédiger des prompts pour Runway Gen-4 Turbo. Réponds en français et rédige le texte final du générateur en anglais. Ne génère ni images ni vidéos.

Vérifie d’abord la documentation disponible :
https://help.runwayml.com/hc/en-us/articles/39789879462419-Gen-4-Video-Prompting-Guide
https://docs.dev.runwayml.com/guides/models/

Résume les principes utiles à l’animation de photos. Une fois la plateforme connue, vérifie les réglages disponibles. Signale les informations non confirmées.

Si je n’ai pas joint d’image de départ, demande-la. Demande aussi les données manquantes : mouvement, plateforme, durée et rapport d’aspect. Ne redemande pas les informations déjà fournies.

Prépare un prompt à partir de la photo et de la description. Considère l’image comme la base de l’apparence de la scène. Concentre-toi sur les mouvements des objets, de la caméra et du décor plutôt que de redécrire chaque détail.

Utilise des formulations positives du résultat souhaité. Au lieu d’interdire le mouvement, indique que la caméra ou l’objet reste immobile. N’ajoute pas de prompt négatif, de pondérations de mots ou d’introductions polies comme « please add ».

Respecte mon idée et prépare un plan cohérent. N’ajoute pas de coupes ou de mouvements indépendants sans demande. Vérifie que l’animation prévue ne contredit pas la photo.

Fournis le prompt dans un bloc de code et les réglages en français. Réutilise la configuration établie pour les photos suivantes.
```

---

## 15. MiniMax Hailuo 2.3 Fast

### Utilisez les bonnes commandes de caméra

La documentation MiniMax présente Hailuo 2.3 Fast comme une variante image-to-video qui utilise une image de départ et une description textuelle de l’animation. Elle répertorie aussi des commandes de caméra entre crochets. [Source : MiniMax — image-to-video](https://platform.minimax.io/docs/api-reference/video-generation-i2v).

| Commande | Mouvement souhaité |
| --- | --- |
| `[Push in]` | Travelling avant : la caméra se rapproche du sujet. |
| `[Truck right]` | Déplacement latéral de la caméra vers la droite, qui change donc de position. |
| `[Pan right]` | Panoramique vers la droite, sans déplacement latéral de la caméra. |
| `[Tilt up]` | Inclinaison de la caméra vers le haut : sa direction de visée change, mais elle ne s’élève pas. |
| `[Static shot]` | Caméra immobile et cadrage fixe. |

La commande définit le type de mouvement. Précisez sa vitesse et le comportement des objets dans une phrase ordinaire :

```text
[Push in]
The camera moves slowly and smoothly toward the coffee package,
keeping its front label fully in view.

The package remains stationary on the table. Steam rises gently
from the cup. The shot ends on a close-up of the package.
```

Rédigez le prompt en anglais et conservez l’écriture d’origine des commandes. Ne traduisez pas en français le contenu des crochets.

### Ne combinez pas les mouvements sans nécessité

La documentation autorise la combinaison de mouvements dans une même paire de crochets et recommande de ne pas dépasser trois commandes simultanées. Pour le premier essai, mieux vaut n’en utiliser qu’une. Vous pourrez ainsi vérifier plus facilement si le modèle produit le bon type de mouvement. [Source : MiniMax — image-to-video](https://platform.minimax.io/docs/api-reference/video-generation-i2v).

Vérifiez également le réglage `prompt_optimizer`. La documentation décrit la réécriture automatique du prompt et la possibilité de la désactiver. Lorsque vous comparez vos propres descriptions précises, le fonctionnement de l’optimiseur peut influer sur l’interprétation des résultats. [Source : MiniMax — image-to-video](https://platform.minimax.io/docs/api-reference/video-generation-i2v).

### Ne transposez pas les fonctions d’autres modèles MiniMax

Dans la documentation citée ci-dessous, le mode distinct utilisant la première et la dernière image concerne Hailuo-02. Il ne confirme pas la prise en charge d’une dernière image par Hailuo 2.3 Fast. [Source : MiniMax — première et dernière image](https://platform.minimax.io/docs/api-reference/video-generation-fl2v).

De même, la fonction audio décrite pour H3 ne confirme pas sa disponibilité dans Hailuo 2.3 Fast. Pour ce workflow, prévoyez le son séparément, sauf indication contraire dans la documentation de l’intégration utilisée.

#### Prompt de départ pour ChatGPT — Hailuo 2.3 Fast

```text
Aide-moi à préparer des prompts pour MiniMax Hailuo 2.3 Fast. Donne les explications en français et les prompts du générateur en anglais. Ne génère pas de vidéos.

Commence par consulter la documentation disponible :
https://platform.minimax.io/docs/api-reference/video-generation-i2v
https://platform.minimax.io/docs/api-reference/video-generation-fl2v
https://hailuoai.video/tools/hailuo-2-3-model

Résume brièvement les règles d’animation d’une photo et les commandes de caméra. Une fois la plateforme connue, vérifie les fonctions de son intégration. Signale ce qui n’a pas pu être confirmé.

Si je n’ai pas joint d’image de départ, demande-la. Complète les informations manquantes : description du plan, plateforme, durée et format d’image. Ne redemande pas les informations déjà fournies.

Prépare un seul prompt centré sur l’animation de la photo. Si l’intégration accepte les commandes MiniMax, choisis celle qui convient dans la documentation et conserve son écriture d’origine entre crochets.

Distingue déplacement de caméra, panoramique, inclinaison et zoom. Précise la vitesse et l’amplitude du mouvement. Ne combine pas plusieurs mouvements sauf si ma description le demande. Fais référence uniquement à une image réellement jointe.

Vérifie la disponibilité de prompt_optimizer. Explique ce réglage séparément du prompt et précise quand son activation entraîne une réécriture automatique de la description avant la génération.

N’attribue pas à ce modèle les fonctions de Hailuo-02 ou H3. N’inclus une dernière image, de l’audio ou un prompt négatif qu’après avoir confirmé leur prise en charge dans le mode choisi.

Fournis le prompt dans un bloc de code et les réglages en français. Pour les photos suivantes, utilise la configuration déjà convenue.
```

---

## 16. MiniMax H3

### Distinguez le cloud, les poids ouverts et le mode 2K

MiniMax H3 génère des vidéos avec un son stéréo. Il prend en charge le texte, la première et la dernière image ainsi que les références, pour une durée officielle de 4 à 15 secondes. La version de base publique fonctionne par défaut en 768p à 24 images/s. [Source : MiniMax — génération vidéo](https://platform.minimax.io/docs/guides/video-generation).

Les poids ouverts de H3 peuvent être exécutés dans ComfyUI. Les workflows prêts à l’emploi comprennent text-to-video, FL2VA pour animer une première et une dernière image, et Ref2VA pour travailler avec des références. Ils peuvent utiliser des balises comme `<Picture 1>`, `<Video 1>` et `<Audio 1>`. Vérifiez toujours la syntaxe propre à l’intégration choisie. [Source : ComfyUI — workflow MiniMax H3](https://docs.comfy.org/tutorials/video/minimax/minimax-h3-native).

Turbo LoRA peut réduire le nombre d’étapes de génération locale, mais ne transforme pas H3 en H3 Max ni en H3 Max Turbo. Le module H3-Regenerate-2K n’a pas été publié pour une installation locale ; le développeur propose ce processus via une API. Un outil de mise à l’échelle classique n’est pas équivalent. [Source : Hugging Face — MiniMax H3](https://huggingface.co/MiniMaxAI/MiniMax-H3).

### Licence et matériel en Pologne

**La licence communautaire de H3 exclut l’Union européenne, donc également la Pologne.** Avant de télécharger les poids pour une utilisation locale, il faut confirmer que vous disposez des droits nécessaires. La licence Professional proposée par Comfy commence à 5 000 USD par mois. Générer dans un service cloud sous licence ne vous accorde pas une licence pour votre propre installation. [Source : Comfy — licence MiniMax](https://comfy.org/minimax/license).

ComfyUI décrit des configurations qui réduisent le besoin total en mémoire à environ 42,5 Go et permettent d’exécuter le modèle avec offloading même sur une RTX 3060. Cela ne signifie pas qu’il faut 42,5 Go de VRAM. Les valeurs ci-dessous constituent un point de départ prudent, pas un minimum garanti pour chaque workflow. [Source : ComfyUI — prise en charge de H3](https://blog.comfy.org/p/minimax-h3-day-0-support-in-comfyui).

| Composant | Point de départ pour les essais | Utilisation plus régulière |
| --- | --- | --- |
| Carte graphique | NVIDIA avec 12 Go de VRAM, configuration économe en mémoire et offloading | NVIDIA avec 24 Go de VRAM et poids adaptés |
| Mémoire vive | 64 Go | 64–128 Go selon le workflow |
| Stockage | SSD NVMe et 100–150 Go d’espace libre | Marge supplémentaire pour les modèles et fichiers de travail |
| Premier essai | Clip court, résolution réduite, une génération | 768p et plans plus longs seulement après mesure de la mémoire utilisée |

Ne promettez pas un temps de génération unique. Faire tourner le modèle et produire confortablement de nombreux essais par jour sont deux exigences différentes.

#### Prompt de départ pour ChatGPT — MiniMax H3

```text
Aide-moi à préparer des prompts pour MiniMax H3. Réponds en français et rédige les prompts prêts pour le générateur en anglais. Ne génère pas de vidéos.

Vérifie d’abord la documentation MiniMax H3 sur le texte, la première et la dernière image et les références. Distingue l’API officielle, les workflows ComfyUI locaux et les fonctions de ma plateforme.

Si je n’ai pas décrit le plan, demande la plateforme, le mode, la durée, le format d’image, les matériaux et le son souhaité. Demande uniquement les informations manquantes. Attribue un rôle précis à chaque référence.

Décris séparément les mouvements de caméra et d’objets. S’il y a plusieurs actions, définis leur ordre et la fin du plan. Ne transpose pas les commandes de Hailuo ni les réglages de H3 Max sans en confirmer la prise en charge.

Pour une installation locale en Pologne, vérifie d’abord la licence, le matériel, la version de ComfyUI, la quantification et l’offloading. Ne confonds pas Turbo LoRA avec H3 Max Turbo et ne promets pas de processus Regenerate-2K local.

Fournis le prompt dans un bloc de code et explique les réglages et limites en français.
```

#### Instruction pour Codex — préparer un test local

```text
Prépare une installation locale de MiniMax H3 dans ComfyUI sur cet ordinateur.

Détecte d’abord le système, le GPU, la VRAM, la RAM, le pilote et l’espace libre. Consulte la documentation actuelle de MiniMax et de ComfyUI. Vérifie les conditions de licence pour un utilisateur en Pologne. Si une autorisation distincte est nécessaire, informe-moi et ne télécharge pas les poids avant confirmation des droits requis.

Après confirmation, prépare une installation isolée, choisis des versions compatibles de PyTorch et des bibliothèques, télécharge uniquement les fichiers officiels nécessaires à un workflow image-to-video, configure la quantification et l’offloading, puis effectue un court test en mesurant le temps et la mémoire utilisés.

Ne confonds pas H3 local ni Turbo LoRA avec H3 Max. N’utilise pas d’API payante, ne change pas les pilotes et ne désactive pas les protections sans mon accord.
```

---

## 17. MiniMax H3 Max

### Considérez H3 Max comme une variante cloud

H3 Max est une variante optimisée pour le suivi des instructions et une génération plus rapide. MiniMax propose 480p et 768p, et l’intégration fal propose aussi 1080p. Les offres vérifiées concernent des services cloud et des API. N’appliquez pas à H3 Max les instructions d’installation destinées aux poids ouverts du H3 classique. [Sources : MiniMax — génération vidéo](https://platform.minimax.io/docs/guides/video-generation), [fal — MiniMax H3 Max](https://fal.ai/minimax-h3-max).

Avant de générer, vérifiez la résolution, la durée, le mode d’entrée et l’enrichissement automatique du prompt. Si la plateforme ne documente pas de champ distinct pour le prompt négatif, formulez vos exigences visuelles dans la description principale.

#### Prompt de départ pour ChatGPT — MiniMax H3 Max

```text
Aide-moi à écrire des prompts pour MiniMax H3 Max. Réponds en français et prépare les prompts finaux en anglais. Ne génère pas de vidéos.

Vérifie d’abord la documentation actuelle de MiniMax et de mon intégration. Distingue H3, H3 Max, H3 Max Turbo et Hailuo. Ne suppose pas que leurs fonctions et réglages sont identiques.

S’il manque des informations, demande la plateforme, la description du plan, la durée, la résolution, le format d’image, les matériaux et le son. Prépare un seul plan cohérent, décris l’ordre des actions et distingue les mouvements de caméra de ceux des objets.

Vérifie le fonctionnement de l’enrichissement automatique du prompt. N’inclus un prompt négatif, des références supplémentaires ou de l’audio qu’après confirmation de leur prise en charge dans le mode précis. Ne présente pas H3 Max comme un modèle aux poids publics pour une installation locale.

Fournis un seul prompt dans un bloc de code et les réglages en français.
```

---

## 18. MiniMax H3 Max Turbo

### Distinguez H3, H3 Max et H3 Max Turbo

Selon fal, H3 Max et H3 Max Turbo sont des variantes développées par fal à partir de MiniMax H3. Il ne faut pas les confondre avec Hailuo 2.3 ni supposer que leurs entrées et paramètres sont identiques. [Source : fal — MiniMax H3 Max](https://fal.ai/minimax-h3-max).

**H3 Max Turbo est l’un des candidats les plus intéressants pour des essais publicitaires peu coûteux, au regard du prix de génération.** Cela n’en fait pas automatiquement le meilleur modèle en qualité ni le moins cher de tout le marché. Comparez surtout le coût d’un plan accepté, et pas seulement celui d’une génération.

| Modèle et service de génération | Tarif de base | 5 secondes | 10 secondes | 30 secondes de vidéo |
| --- | ---: | ---: | ---: | ---: |
| H3 Max Turbo, 768p — fal, promotion | 0,02 USD/s | 0,38 PLN | 0,76 PLN | 2,28 PLN |
| H3 Max Turbo, 1080p — fal, promotion | 0,04 USD/s | 0,76 PLN | 1,52 PLN | 4,56 PLN |
| H3 Max Turbo, 768p — Magnific Premium+, abonnement annuel | 200 crédits / 5 s | 0,47 PLN | 0,94 PLN | 2,83 PLN |

Données au **18 septembre 2026**. La promotion fal prend fin le 30 septembre 2026 ; selon la grille publiée, les tarifs doivent ensuite doubler. Les chiffres Magnific supposent l’utilisation de l’intégralité des 600 000 crédits annuels.

La description peut associer image, caméra et son, à condition que le mode choisi les prenne en charge. Pour plusieurs actions successives, précisez ce qui se passe d’abord, ce qui suit et comment le plan se termine.

L’exemple suppose une image de départ montrant un emballage et une tasse posés sur un plan de travail :

```text
One continuous shot based on the starting image. The camera is
initially stationary, and the coffee package stays fixed throughout.

A hand enters from the right and gently rotates the cup on the table
until its handle points toward the camera. The hand releases the cup
and leaves the frame.

The camera then slowly moves forward toward the package, keeping
the front label in view. It gradually slows to a stop and holds
a close-up for the end of the shot.

Audio: quiet indoor ambience and a soft scraping sound as the base
of the cup moves across the table.
```

La tasse reste sur le plan de travail pendant sa rotation, la main termine son geste avant le travelling avant et la caméra s’arrête à la fin. Inutile de décrire à nouveau toutes les couleurs et tous les objets visibles sur la photo.

L’anglais est la langue de travail retenue dans ce guide. Ce choix ne découle pas d’un test comparant l’efficacité de différentes langues dans H3 Max Turbo.

### Vérifiez l’enrichissement automatique du prompt

Le schéma de l’API fal décrit le paramètre `prompt_expansion_mode`, avec les options `balanced`, `quality` et `disabled`. Cette dernière désactive l’enrichissement. La réponse peut aussi contenir le texte réécrit. [Source : fal — H3 Max Turbo, text-to-video](https://fal.ai/models/minimax/h3-max-turbo/text-to-video/api).

Pour une idée générale, l’enrichissement peut faire partie du workflow choisi. Pour un scénario précis, comparez le résultat avec la réécriture désactivée, si la plateforme le permet. N’évaluez pas seulement le texte saisi : vérifiez aussi s’il a été enrichi avant la génération.

Ne transposez pas dans H3 Max les commandes entre crochets de Hailuo sans en confirmer la prise en charge. Le schéma de base H3 Max Turbo décrit ici ne mentionne pas non plus de champ distinct `negative_prompt`. [Source : fal — H3 Max Turbo, text-to-video](https://fal.ai/models/minimax/h3-max-turbo/text-to-video/api).

#### Prompt de départ pour ChatGPT — H3 Max Turbo

```text
Aide-moi à écrire des prompts pour MiniMax H3 Max Turbo. Réponds en français et prépare les prompts finaux en anglais. Ne génère pas de vidéos.

Consulte d’abord la documentation disponible :
https://fal.ai/minimax-h3-max
https://fal.ai/models/minimax/h3-max-turbo/text-to-video/api
https://platform.minimax.io/docs/guides/video-generation

Distingue H3, H3 Max, H3 Max Turbo et Hailuo. Résume les règles du modèle choisi. Quand je donne la plateforme, vérifie les fonctions de son intégration. Signale les informations non confirmées.

Si je n’ai pas décrit le plan, demande sa description, la plateforme, la durée, le format d’image, les matériaux et le son souhaité. Demande uniquement les informations manquantes. Dès que la description est complète, prépare le prompt.

Décris l’action et le mouvement de caméra dans des phrases naturelles. Pour plusieurs actions, définis leur ordre et leur fin. Pour l’animation d’une première image, concentre-toi sur les changements sans répéter toute la description de la photo.

Associe les sons à des événements précis et les dialogues à des personnages définis. Conserve le texte et la langue des répliques et vérifie la prise en charge de la parole. N’ajoute pas d’actions, de coupes ou d’effets non demandés.

Vérifie prompt_expansion_mode et explique les réglages disponibles en dehors du prompt. Ne transpose pas automatiquement les commandes de caméra de Hailuo. N’inclus un prompt négatif ou des références supplémentaires que si le mode précis les accepte.

Fournis un seul prompt dans un bloc de code et les réglages en français. Distingue les recommandations documentées de tes propres suggestions. Pour les plans suivants, utilise la configuration déjà convenue.
```

---

## 19. Wan 3.0

### Utilisez les instructions de la bonne version

Les ressources fal citées ci-dessous décrivent la génération à partir de texte, d’images et de références. Elles mentionnent aussi l’enrichissement automatique du prompt et une planification supplémentaire avant la génération. [Source : fal — Wan 3](https://fal.ai/wan-3).

Cela ne signifie pas que vous pouvez reprendre sans vérification les réglages et longues listes négatives des configurations locales Wan 2.x. Consultez la documentation du mode Wan 3.0 précis que vous utilisez.

L’anglais est la langue de travail adoptée ici. Cette convention ne signifie pas que le modèle fonctionne toujours mieux en anglais qu’en chinois ou dans une autre langue.

### Décrivez la scène et son déroulement

En text-to-video, commencez par le lieu et la disposition des objets. Définissez ensuite le mouvement et le cadrage final.

```text
A close-up product shot in a small, sunlit kitchen. A coffee package
stands beside a ceramic cup on the counter.

The package is slightly to the right of center in the opening frame.
The camera tracks slowly to the right, parallel to the counter,
with a fixed viewing direction. The move ends with the package near
the center of the frame and its front label fully visible.

Steam rises gently from the cup while the package remains stationary.

Audio: quiet kitchen ambience and the faint sound of a kettle
in the background.
```

La position initiale du produit et le sens du déplacement sont liés. La description n’exige pas à la fois une direction de visée fixe et un produit constamment centré pendant tout le mouvement.

Attribuez un rôle précis à chaque référence. Le schéma Wan 3.0 décrit la désignation des images et vidéos selon leur position dans la liste des entrées. Utilisez la notation de cette intégration, sans reprendre automatiquement les balises de Seedance. [Source : fal — Wan 3.0, reference-to-video](https://fal.ai/models/alibaba/wan-3.0/reference-to-video/api).

```text
Use the first reference image for the coffee package's shape,
colors, and label design.

Use the first reference video only for the camera movement.
Place the package in a new, bright kitchen setting rather than
recreating the background from the reference video.
```

### Réglez les paramètres en dehors du prompt

Dans l’intégration décrite, `enable_thinking` et `enable_prompt_expansion` sont des réglages distincts. Écrire « think carefully » dans la description de la scène ne revient pas à modifier leurs valeurs.

Pour un plan publicitaire préparé, définissez la durée et le format plutôt que de les laisser en automatique. Vous comparerez plus facilement les essais successifs.

Le schéma de base text-to-video décrit ici ne mentionne pas de champ distinct `negative_prompt`. Indiquez donc vos exigences concernant l’apparence du produit dans la description principale, sans ajouter de paramètre non pris en charge. [Source : fal — Wan 3.0, text-to-video](https://fal.ai/models/alibaba/wan-3.0/text-to-video/api).

#### Prompt de départ pour ChatGPT — Wan 3.0

```text
Aide-moi à préparer des prompts pour Wan 3.0. Donne les explications en français et les prompts finaux en anglais. Ne génère pas de vidéos.

Consulte d’abord la documentation disponible :
https://fal.ai/wan-3
https://fal.ai/models/alibaba/wan-3.0/text-to-video/api
https://fal.ai/models/alibaba/wan-3.0/reference-to-video/api

Résume brièvement les règles de la version 3.0. Une fois la plateforme connue, vérifie les fonctions du mode choisi. Ne transpose pas automatiquement les paramètres de Wan 2.x. Signale les informations non confirmées.

Si je n’ai pas décrit la scène, demande sa description, la plateforme, la durée, le format d’image, les matériaux et le son souhaité. Demande uniquement les informations manquantes. Dès que la description est complète, prépare le prompt.

En text-to-video, décris l’apparence de la scène et le mouvement. En image-to-video, concentre-toi sur l’animation. Attribue des rôles précis aux références et utilise la notation acceptée par l’intégration. Ne copie pas les balises d’autres modèles.

Sépare les mouvements de caméra de ceux des objets. Vérifie la cohérence entre position initiale, direction du mouvement et cadrage final. Décris les actions successives dans un ordre logique.

Décris le son séparément, en accord avec l’image. Attribue les dialogues aux personnages, conserve leur texte et leur langue, et vérifie la prise en charge de la parole.

Explique enable_thinking et enable_prompt_expansion en français, hors du prompt. Ne les remplace pas par des commandes dans la description de la scène. N’ajoute un prompt négatif qu’après confirmation de la disponibilité de ce champ.

Fournis le prompt final dans un bloc de code et les réglages en français. Pour les plans suivants, utilise la configuration déjà convenue.
```

---

## Comment décrire un plan dans le message suivant à ChatGPT ?

Vous n’avez pas besoin de connaître les termes techniques des mouvements de caméra. Décrivez simplement ce qui doit se passer. L’essentiel est de distinguer le mouvement de la caméra du comportement des objets et de préciser le rôle de la pièce jointe.

Exemple de message après avoir choisi un modèle :

```text
Plateforme : Higgsfield.
Modèle : celui que nous avons choisi plus tôt dans cette conversation.
Durée : 10 secondes. Si ce mode n’accepte pas cette durée, indique les options disponibles.
Format d’image : vertical 9:16.

La photo jointe doit servir de première image de la vidéo, et pas simplement de référence pour l’apparence du produit.

Je souhaite un plan publicitaire calme. La caméra doit se déplacer lentement vers la droite en ligne droite, tout en se rapprochant légèrement du produit. Je ne parle ni d’un mouvement orbital autour de lui ni d’un zoom.

Le produit doit rester au même endroit pendant tout le plan et ne pas tourner. La face avant de l’emballage doit rester visible. À la fin, il me faut un peu d’espace libre au-dessus du produit pour ajouter du texte plus tard dans Premiere.

Pas de dialogue. J’ajouterai moi-même le son au montage. Conserve l’environnement et l’éclairage de la photo. N’ajoute pas de personnes ni d’objets.

Les priorités sont l’apparence inchangée du produit et la fluidité du mouvement de caméra. Si le cadrage proposé est incompatible avec la photo, signale le problème au lieu de modifier toi-même le concept.
```

Le *format d’image*, ou *aspect ratio*, désigne le rapport entre la largeur et la hauteur. La notation 9:16 correspond à un cadre vertical ; elle n’indique pas le nombre de pixels. Choisissez séparément la résolution parmi les réglages proposés par la plateforme.

Dans votre message à ChatGPT, vous pouvez formuler des interdictions en français, comme « le produit ne doit pas tourner ». Il s’agit d’une consigne de travail, pas d’un prompt prêt pour le générateur. Le chat doit traduire votre intention dans une formulation adaptée au modèle, par exemple « The package remains stationary » dans Runway.

## Comment améliorer un prompt après une génération ratée ?

Au lieu d’écrire simplement « fais mieux », indiquez l’écart entre votre intention et le résultat. Le retour le plus utile précise l’objet concerné, le type d’erreur et le moment où elle apparaît.

Vague :

> Cela fait artificiel.

Précis :

> La caméra a décrit un arc alors qu’elle devait se déplacer latéralement en ligne droite. À partir de la troisième seconde, l’emballage s’élargit. Le mouvement de la vapeur est réussi : ne modifie pas la consigne qui le concerne.

Corrigez une seule catégorie de problème à la fois. Vous pourrez mieux juger si la modification du prompt a réellement aidé.

| Problème | Points à vérifier ou à modifier |
| --- | --- |
| Le produit tourne au lieu de la caméra | Décrivez séparément le produit immobile et le mouvement de caméra souhaité. |
| Des coupes indésirables apparaissent | Vérifiez le mode Multi-Shot et les formulations qui suggèrent le passage à un autre plan. |
| L’apparence du produit change | Vérifiez la qualité du matériau d’entrée, le rôle des références et l’amplitude du mouvement. Allonger le prompt ne résout pas la cause à lui seul. |
| Le personnage agit dans le mauvais ordre | Ordonnez les actions et précisez l’état de la scène après chacune. |
| La mauvaise personne prononce le dialogue | Désignez les personnages de façon constante et attribuez chaque réplique séparément. |
| Le résultat s’écarte d’une description précise | Vérifiez si la plateforme enrichit ou réécrit automatiquement le prompt et tenez-en compte lors des comparaisons. |

L’amélioration progressive des consignes correspond à l’approche décrite par Runway. Dans les intégrations MiniMax et Wan présentées ici, les réglages qui transforment le prompt avant la génération peuvent également jouer un rôle. [Sources : Runway — guide Gen-4](https://help.runwayml.com/hc/en-us/articles/39789879462419-Gen-4-Video-Prompting-Guide), [MiniMax — image-to-video](https://platform.minimax.io/docs/api-reference/video-generation-i2v), [fal — Wan 3.0, text-to-video](https://fal.ai/models/alibaba/wan-3.0/text-to-video/api).

### Quels points la documentation ne tranche-t-elle pas ?

Ce guide cite surtout des ressources détaillées pour Runway, Veo, Kling et Seedance 2.5. Il ne présente pas de manuel de prompting dédié aussi complet pour Seedance 2.0 Mini. Le nom « Seedance 2 Pro » doit être identifié sur la plateforme concernée. Il ne cite pas non plus d’études comparables permettant de désigner une seule langue de prompt comme la meilleure pour tous les modèles présentés.

Plutôt que de retenir une recette universelle comme « toujours 150 mots, toujours en anglais, toujours une longue liste négative », consignez la configuration des essais réussis : modèle, plateforme, mode, matériaux, prompt et réglages. Pour le plan suivant, vous aurez un point de comparaison concret plutôt qu’une règle générale qui ne convient peut-être pas à l’outil choisi.

---

*Note éditoriale : la langue, la syntaxe, la cohérence des consignes et la logique des scènes d’exemple ont été révisées. Les informations sur les fonctions des modèles et les liens ont été conservés d’après l’article fourni. Cette révision ne comprend ni nouvelle vérification de la documentation ni tests des générateurs.*
