Tous les outils

Devenir un géant dans sa ville avec l'IA

Votre selfie part vers trois nodes Wan 3.0 qui vous rendent à l'échelle d'un immeuble dans une vraie rue : vous enjambez les voitures, vous êtes assis sur un toit, vous soulevez un bus entre deux doigts.

Démo interactive

Vrai workflow, résultats réels. Déplacez-vous et zoomez librement.

Utiliser ce workflow

Le workflow réel : le selfie câblé en référence à trois nodes Wan 3.0, une mise en scène par node. Les trois vidéos sont celles de la démo, le même visage et la même veste.

En bref

Ce que le workflow produit
3 vidéos de 15 s en 720p, format 9:16
Structure du canvas
8 nodes reliés par 6 liaisons
Modèles câblés
Wan 3.0
Coût d'un passage complet
environ 180 crédits, soit 1,80 €

Un selfie suffit. Pas de plan à tourner, pas de fond vert, pas de montage : votre photo entre dans trois nodes et vous ressortez à l'échelle d'un immeuble, au milieu d'une vraie rue, filmé depuis le trottoir en contre-plongée.

Les trois mises en scène de la démo racontent trois rapports de taille : vous enjambez une file de voitures à l'arrêt, vous êtes assis sur un toit haussmannien comme sur un banc, vous soulevez un bus entier entre le pouce et l'index pour le regarder.

Ce qui fait l'effet n'est pas votre taille, c'est l'ÉCHELLE du décor. Les consignes insistent pour que les voitures, les passants et les bus restent de vraies tailles réelles, sinon le modèle rend une maquette. Wan 3.0 accepte un visage réel en référence et le garde, là où d'autres modèles le refusent ou le redessinent. Les trois vidéos coûtent cent quatre-vingts crédits.

Comment faire

  1. 1

    Donnez un selfie net

    Cadré à mi-buste, de face, en lumière du jour, sur un fond quelconque. C'est le seul élément qu'on vous demande, et il n'a pas besoin d'être beau, il a besoin d'être net.

  2. 2

    Ne décrivez pas votre visage

    La consigne renvoie à la photo de référence et ne décrit jamais vos traits. Dès qu'on décrit un visage, le modèle croit devoir le refaire, et il le refait à sa façon.

  3. 3

    Gardez la contre-plongée

    La caméra au niveau de la rue, tournée vers le haut, est ce qui donne la sensation de hauteur. Vue de face à votre hauteur, la même image ne raconte plus rien.

  4. 4

    Générez les trois, puis changez de ville

    « Tout générer » sort les trois plans. Ensuite, remplacez les façades haussmanniennes par votre vraie ville dans la consigne, et relancez le node qui vous intéresse.

Variantes et cas d'usage

Le même canvas, réglé pour des besoins différents : chaque variante tient en deux ou trois lignes de prompt à changer.

Enjamber l'avenue

Le plan de référence du genre : les voitures à la taille de chaussures entre vos baskets, les piétons qui s'écartent, votre tête au dessus des toits. C'est celui qui se comprend le plus vite.

Assis sur un immeuble

Les avant-bras sur les genoux, les pieds pendant devant les fenêtres du troisième étage. Le calme de la pose contraste avec la taille, et c'est ce contraste qui fait l'image.

Le bus entre deux doigts

Un vrai bus, avec ses vitres et ses passagers, minuscule dans votre main. C'est le plan qui donne le mieux la mesure, parce que tout le monde connaît la taille d'un bus.

Votre ville plutôt que Paris

Remplacez les façades haussmanniennes par ce qui caractérise chez vous : des maisons de brique, une place de marché, un front de mer. L'effet gagne beaucoup quand le décor est reconnaissable.

L'annonce d'un événement

Un géant qui domine la ville fait une accroche d'affiche animée pour un concert, une soirée ou une ouverture. Le nom et la date se posent ensuite au montage, pas dans la vidéo.

L'inverse, tout petit

La même mécanique fonctionne en miniature : demandez que vous soyez haut de dix centimètres sur une table de cuisine, avec des couverts à votre échelle. Le verrou de cohérence reste le même.

Erreurs fréquentes

Donner un selfie de nuit ou flou

Le modèle reprend ce qu'il voit : un visage sombre ou bougé ressort sombre ou approximatif sur les trois plans. Une photo de jour, nette, change tout le résultat.

Décrire son visage dans la consigne

Dès qu'on écrit la couleur des yeux ou la forme du nez, le modèle reconstruit un visage au lieu de reprendre le vôtre. La consigne parle du décor, la photo parle de vous.

Oublier l'échelle du décor

Sans la phrase qui impose de vraies voitures et de vrais passants, le modèle fabrique une maquette où tout est petit, et vous n'avez plus l'air grand, vous avez l'air normal dans un décor de train électrique.

Cadrer la caméra à votre hauteur

Vu de face au niveau du visage, un géant ressemble à un portrait. C'est la contre-plongée depuis la rue qui fabrique la hauteur, et la consigne doit le dire.

Modèles recommandés

Questions fréquentes

Faut-il une photo de la rue ?

Non, la rue est décrite dans la consigne et fabriquée par le modèle. Si vous voulez votre rue exacte, décrivez-la précisément ou passez par la vidéo meme, qui part d'une photo de votre rue.

La ressemblance est-elle bonne ?

Sur les trois plans de la démo, oui : c'est le même visage et la même veste qu'au départ. La ressemblance tient mieux en plan large qu'en très gros plan, ce qui tombe bien pour un géant.

Puis-je apparaître à deux ?

Le node accepte jusqu'à dix images de référence, donc oui, ajoutez un deuxième selfie et nommez les deux personnes dans la consigne. Attendez-vous à plus d'essais pour que les deux visages tiennent ensemble.

Combien coûtent les trois plans ?

Cent quatre-vingts crédits, soixante par vidéo de cinq secondes en 720p avec le son. Relancer un seul plan après avoir changé la ville ne coûte que soixante crédits.

Puis-je enchaîner les trois plans ?

Oui, le node Montage assemble les trois dans le navigateur, sans logiciel et sans crédit supplémentaire. Quinze secondes de géant font une vidéo complète.

Le rendu est-il utilisable commercialement ?

Les images le sont, dans les conditions expliquées par le guide sur les droits des images IA. Attention en revanche aux marques visibles sur les bus et les devantures que le modèle invente.

Pourquoi une image en référence et pas une vidéo ?

Parce qu'il n'y a rien à filmer : la scène n'existe pas. Le node n'a donc pas de plan de départ, c'est le modèle qui compose le cadre autour de votre photo.

Quel format en sortie ?

Du vertical 9:16 en 720p, le format natif des réseaux. Le node propose aussi le 16:9 si la vidéo part sur YouTube.

Devenir un géant dans sa ville avec l'IA

Utiliser ce workflow

Compte gratuit, sans carte bancaire. Le workflow s'ouvre pré-rempli dans votre canvas.