La vague en décalé
Cinq copies en arc de cercle qui reprennent votre geste l'une après l'autre, avec un temps de retard. C'est le traitement le plus lisible, et celui qui marche le mieux sur un geste simple.
Votre plan filmé au téléphone part vers trois nodes Wan 3.0 qui vous démultiplient : cinq copies qui reprennent votre geste en décalé, des copies à toutes les échelles, une foule entière de vous.
Vrai workflow, résultats réels. Déplacez-vous et zoomez librement.
Utiliser ce workflowLe workflow réel : le plan de départ câblé en référence à trois nodes Wan 3.0, un traitement de clonage par node. Les trois vidéos sont celles de la démo, le même visage sur toutes les copies.
En bref
Le clonage vidéo demandait un trépied, un fond fixe, plusieurs prises et un masque par personnage. Ici il demande un plan de cinq secondes filmé à la main : vous frappez dans vos mains, vous faites un pas, et le modèle remplit le cadre de vous.
Les trois traitements de la démo ne clonent pas de la même façon : cinq copies en arc de cercle qui reprennent votre geste avec un temps de retard, comme une vague ; des copies à toutes les tailles qui se croisent en glissant ; et une foule entière, serrée épaule contre épaule jusqu'au fond.
Le point dur n'est pas le nombre de copies, c'est leur FIDÉLITÉ : dès qu'une copie sort avec un autre visage ou une autre veste, l'effet tombe. Les trois consignes répètent donc que chaque copie est la même personne. Wan 3.0 prend votre plan en référence et garde le visage, la tenue et le geste. Les trois vidéos coûtent cent quatre-vingts crédits.
Filmez dans un endroit dégagé
Un hall, un parking, une pièce vide, un fond simple. Les clones ont besoin de place, et un décor chargé en cache la moitié derrière les meubles.
Un geste court et net
Une frappe dans les mains, un pas de côté, un salut. Un geste simple se répète proprement d'une copie à l'autre, là où une phrase ou une chorégraphie se désynchronise.
Gardez la phrase de fidélité
Chaque consigne dit que toutes les copies sont la même personne, mêmes vêtements compris. C'est elle qui empêche le modèle de peupler le cadre d'inconnus qui vous ressemblent vaguement.
Générez les trois, comparez
« Tout générer » sort les trois traitements. Le décalé raconte une idée, la foule fait l'effet, l'échelle fait l'image : le choix dépend de ce que vous racontez.
Le même canvas, réglé pour des besoins différents : chaque variante tient en deux ou trois lignes de prompt à changer.
Cinq copies en arc de cercle qui reprennent votre geste l'une après l'autre, avec un temps de retard. C'est le traitement le plus lisible, et celui qui marche le mieux sur un geste simple.
Des versions de vous énormes au premier plan, minuscules au fond, à hauteur de genou, qui glissent l'une devant l'autre. Un rendu graphique, proche des montages de mode.
Des dizaines de vous serrés du premier plan jusqu'au mur, qui frappent dans leurs mains au même instant. C'est le plus spectaculaire, et le plus difficile à faire tenir sur la ressemblance.
Deux copies face à face qui se répondent, filmées d'un plan de vous parlant. Un format de vidéo courte qui tourne beaucoup, et qui demande un geste très posé au départ.
Un indépendant qui se démultiplie en réunion, en tournage, au service client. L'image dit en trois secondes ce qu'un paragraphe explique mal sur une page à propos.
Un pas de danse repris par toute la foule au même instant. Gardez le mouvement court : plus il dure, plus les copies du fond finissent par partir chacune de leur côté.
Un canapé, une table et une étagère mangent la place où les clones devraient se tenir, et le modèle en pose deux au lieu de dix. Un mur nu et du sol dégagé valent mieux qu'un joli décor.
Une chorégraphie de cinq secondes se désynchronise entre les copies et donne une foule qui s'agite sans raison. Deux secondes de geste clair, tenues, valent mieux.
Sans cette phrase, le modèle remplit le cadre d'hommes et de femmes qui vous ressemblent de loin, et l'effet de clonage disparaît au profit d'une simple foule.
Un motif compliqué ou un logo précis se dégrade sur les copies éloignées. Une tenue unie tient beaucoup mieux la répétition, et c'est ce que fait la démo.
La foule de la démo en compte plusieurs dizaines. Au delà, le modèle perd la ressemblance sur les copies du fond, ce qui se voit peu en vertical mais se voit sur un grand écran.
Cela se demande. Le premier traitement les décale volontairement d'une fraction de seconde pour créer une vague, le troisième les fait frapper toutes au même instant.
Filmez-les toutes les deux dans le plan de départ et demandez que chaque groupe de copies garde la bonne personne. C'est plus fragile qu'avec une seule, attendez-vous à plusieurs essais.
Cent quatre-vingts crédits pour les trois traitements, soixante par vidéo de cinq secondes en 720p avec le son. Relancer un seul traitement ne coûte que soixante crédits.
Le node génère l'audio avec la vidéo, et la foule frappe dans ses mains dans un seul claquement. Pour un rendu précis, remplacez le son au montage.
Oui, le node Montage les assemble dans le navigateur sans crédit supplémentaire. Quinze secondes de clonage font une vidéo qui se tient seule.
Entre une et quinze secondes. Cinq suffisent, et un plan plus court laisse moins d'occasions au modèle de perdre la ressemblance.
Oui, la mécanique ne suppose pas un humain. Filmez votre chien dans un couloir vide et demandez des copies fidèles : le verrou de ressemblance s'applique de la même façon.
Se cloner en vidéo avec l'IA
Utiliser ce workflowCompte gratuit, sans carte bancaire. Le workflow s'ouvre pré-rempli dans votre canvas.