「ゲームの中にいる」リール
このワークフローの元になったフォーマットです。縦で撮った動き、その周りにゲームの世界、5 秒。ノードは世界の音付きで 9:16 に直接描き出すので、そのまま投稿できます。
スマホで撮った自分のクリップをキャンバスに入れると、Wan 3.0 が同じ人物、同じ動きをビデオゲームのステージの中に描きます。神殿の遺跡、キューブの世界、UI付きのネオンの屋上:ワークフロー全体と三つの結果を、アカウントなしで見られます。
本物のワークフロー、本物の結果。自由に移動・ズームできます。
このワークフローを使う本物のワークフロー:廊下で撮ったありふれたクリップ、動画ポートから参照としてそれを受け取る Wan 3.0 の動画ノード三つ、そして人物を描写してから行き先の世界を描写する三つの指示。
概要
発想の元は、誰かが「本人のまま」ゲームの中にいるあの動画です。人物は撮影されたもので、周りの世界はゲームのもの。その対比が笑わせ、驚かせます。ここにはグリーンバックも合成ソフトもありません。廊下でスマホで撮ったクリップがノードの動画ポートから入り、同じ人物が谷の上で石の足場から足場へ飛び移りながら出てきます。
クリップは編集されるのではなく参照として渡されます。Wan 3.0 はそれをキャラクターシートのように読みます。顔、お団子、黄色いパーカー、ジャンプ、最後の笑顔。そして指示が描写する世界の中でそれらを保ったまま、新しい動画を生成します。だから指示は二つの半分から成ります。まず人物、撮影された本物の人間のままだと明記し、次に世界と、世界が人物に投げかける光です。
同じクリップを三つのノードが受け取るのは、世界は比べて選ぶものだからです。アドベンチャーゲームのジャングルの神殿の遺跡、彼女以外のすべてがブロックでできたキューブの世界、そして体力バーとミニマップを画面に重ねたアクションゲームのネオンの屋上。一つの世界は 720p、音声付き 5 秒で60 クレジット、三つ合わせて 180 クレジット、2 ドル強です。
ゲームで意味のある動きを撮る
跳ぶ、バランスを取って歩く、狙う、さっと振り返る。5 秒から 10 秒、引きの構図で全身をフレームに入れます。何も起きないクリップからは、何も起きない世界しか生まれません。
デモのクリップを自分のものに差し替える
メディアノードはスマホから取り込んだ動画を受け付けます。三つの動画ノードはすでにそこに配線済みで、つなぎ直しは不要です。長さ、フォーマット、解像度はノード側で設定し、参照はそれらを強制しません。
人物を描写し、それから世界を描写する
参照動画の人物であること、顔、服装、動き、そして撮影された本物の人間のままであることを書きます。次に今その人が歩いている地面、世界の光がその人に当たる様子、必要なら UI を書きます。
生成して、比べて、成立する世界を残す
三つの結果を並べれば、どれかが一番よくできています。それだけを指示を直して再実行してください。ノードごとに個別に課金され、他の二つはそのままです。
同じキャンバスを、別の用途に合わせて調整。各バリエーションは、プロンプトを2〜3行変えるだけです。
このワークフローの元になったフォーマットです。縦で撮った動き、その周りにゲームの世界、5 秒。ノードは世界の音付きで 9:16 に直接描き出すので、そのまま投稿できます。
それぞれが 5 秒自分を撮り、それぞれが同じ世界をくぐり、編集で並べます。編集ノードはブラウザの中で結果を組み立て、クレジットはかかりません。
描写する舞台はあなたのものです。あなたの色、あなたの UI、あなたの敵。その中を跳ぶ本物の人間は、スクリーンショットよりもスケールと空気をよく伝えます。
一つの元動画、十個の動画ノード、十個の指示。クリップは撮り直さず、ノードごとに世界が変わり、比較はキャンバスの上で行います。
ゲームの名前を出さずに世界を描写します。キューブ、遺跡、石のブロック。子どもは画面の中で本人のままで、祖父母に動画を見せるときにはそれが大事です。
Wan 3.0 は世界の音をすでに出しますが、その上に重ねるゲーム音楽は歌を作るワークフローで生成し、編集ノードに置きます。
腕を下ろして立ったままでは、結果は背景の中の写真になります。動きがゲームを作ります。跳ぶ、バランスを取って歩く、狙う。5 秒の動きは 10 秒のポーズに勝ります。
その一文がないと、モデルは動画を雰囲気として読み、別の誰かを作り出します。指示は人物から始めます。参照動画の人物、顔、服装、動き、そして撮影された本物の人間のままであること。
ゲームのタイトルはモデルにほとんど何も与えず、権利の問題も生みます。見えるものを描写してください。地面、光、物、UI。「テクスチャ付きのキューブ、四角い太陽」で十分です。
松明の神殿なのにパーカーに温かい光が当たらなければ、貼り付けた背景のままです。服と顔に当たる舞台の光を必ず頼んでください。それが本人がそこにいると感じさせます。
はい、それがこの効果の核心で、デモは三つの世界でそれを示しています。顔、お団子、黄色いパーカー、ジャンプは三つとも同じで、最後の笑顔まで一致します。一枚の画像ではなく動画全体が参照になるので、動きが保たれます。
はい、Wan 3.0 では実測済みで、このモデルはクリップを拒否したことがありません。Seedance 2.5 は受け付けたときはさらに良く、描き直すのではなくクリップそのものを編集しますが、そのフィルターは本物でも生成物でも時に人物を拒否します。このデモのテスト用クリップも拒否されました。実在の人物を拒否するモデルでは、ノードが生成前に警告します。
はい、画面に重ねて描かれる要素として描写してください。体力バー、その色、その位置、ミニマップ、スコア。デモの三つ目の結果がまさにそれです。ゲームの名前を出すのではなく、見えるものを描写してください。
Wan 3.0 で 720p、音声付き 5 秒あたり 60 クレジット、つまり 72 セントです。デモの三つの世界で 180 クレジット。価格はクリックする前に各ノードに表示されます。
参照としては 1 秒から 15 秒。出力はノードで設定した長さで、2 秒から 30 秒です。5 秒のクリップを 5 秒で描けば動き全体が保たれ、それがデモの設定です。
いいえ。フォーマットは参照動画とは独立にノードで選びます。横で撮ったクリップを縦で出すことも、その逆もできます。デモが 9:16 なのはリールのフォーマットだからです。
はい、ノードは動画入力を受け付けるすべてのモデルを提示します。Seedance 2.5 はクリップそのものを編集するので、フィルターが通せば最も忠実です。Wan 3.0 Prime は四割増しの価格でより精細に描きます。Grok Imagine Video もクリップを受け付けますが、人物を描き直します。別の服、別の構図、もうあなたではありません。
はい、むしろそれが自然な使い方です。撮って、取り込んで、実行する。スマホで作るガイドがキャンバスの操作を説明しています。