キャンバスとノード
テキスト、画像、動画、メディア、リファレンス、スタイル。ノードをつないでワークフローを組み立てる方法を解説します。
ノードの種類
テキストノードはアイデアやプロンプトを保持し、言語モデル(GPT-5、Claude、Geminiなど)に書かせることもできます。画像ノードと動画ノードはAIでコンテンツを生成します。メディアノードは自分のファイルを取り込みます。カメラノードはシーンを見つめる視点を設定します。リファレンスノードは繰り返し登場するキャラクターやオブジェクトを記憶します。スタイルノードはアートディレクションを統一します。
各ノードは自由に動かせます。削除は×ボタンまたはDeleteキーで。Ctrl+Z / Ctrl+Yで元に戻す・やり直しができます。
ノードをつなぐ
ノード右側のハンドルから別のノード左側のハンドルへケーブルを引きます。テキストノードを画像ノードの「プロンプト」ポートにつなぐと、そのテキストがプロンプトに追加されます。何が反映されているかは、ノード内の青い枠で確認できます。画像ノードを動画ノードにつなぐと、その画像が最初のフレームになります。画像タイプのメディアノードはビジュアルリファレンスとして働きます。
一部の動画モデルは終了画像も受け付けます。モデルが対応していれば、「終了画像」ポートが自動的に表示されます。
@リファレンスとスタイル
名前、説明、写真を設定してリファレンスノードを作成すれば、あなたのキャラクターのできあがりです。あとはどのプロンプトでも@と入力するだけ。リファレンスの一覧が表示され、選んだメンションはネオングリーンで表示されます。生成時には説明がプロンプトに挿入され、画像も添付されます(Seedream 5 LiteやGPT Image Miniなど、編集対応モデルの場合)。
スタイルノードも仕組みは同じですが、接続して使います。画像ノードや動画ノードにつなげば、どこでも同じアートディレクションを保てます。
組み合わせる
完全なワークフローの例:テキスト → 画像(Flux 2 Klein)→ 動画(Kling)。両方にカメラノードをつないで統一感のある仕上がりにし、スタイルノードも共有します。画像ノードと動画ノードはそれぞれ生成履歴を保持しており、サムネイルをクリックすればいつでも戻れます。すべて自動で保存されます。
レタッチノード
レタッチノードは、キャンバス上の小さなレイヤー工房です。画像ノードやメディアノードをレイヤーポートにつなぐと、各画像がレイヤーになり、移動、拡大縮小、回転、不透明度の調整、他のレイヤーとの合成ができます。消しゴムで領域を透明にし(被写体の切り抜きや、下のレイヤーを覗かせる窓)、復元ブラシで元に戻せます。上にテキストを載せ、ドキュメントのサイズと背景を選んで書き出せば、PNGは透明を保ったまま。すべてブラウザ内で計算され、クレジットは不要です。
各画像レイヤーにはAIアクションが2つあります。領域のレタッチ(塗って、説明すると、Nano Bananaが置き換える)と拡大(Topaz、×2または×4)で、他のノードと同じ価格です。ワンクリックで前の画像に戻せます。ノードの出力は、画像がつながる場所ならどこにでも接続できます。動画の開始フレーム、参照、モンタージュなど。
動画ツール:モーション、延長、リップ、背景
Videoノードは生成するだけではありません。選んだモデルによっては、既存の動画を変換します。Kling 3.0 Motion Controlは動画の動き(「モーション動画」ポート)を取り込み、画像(imageポート)のキャラクターにそれを再現させます。ダンス、歩き方、振り付けなど、どんな顔にも適用できます。Grok Imagine(延長)は動画の最後のフレームから続きを、同じフォーマットで生成します。追加する秒数を設定し、次に起こることを記述するだけです。続きの動画は単独で出力され、Montageノードでつなぎ合わせます。
Sync Lipsync 3は、動画の唇の動きを接続した音声(voiceポート)に合わせて調整します。別の言語、別のセリフを、同じ映像の上で。InfiniTalkは写真から同じことを行います。音声の長さ全体にわたって、表情も含めて顔がしゃべります。Bria video backgroundは動画から背景を取り除き、被写体とその音声だけを残します。編集用の透過webm、またはグリーン、黒、白背景のmp4として出力されます。
これら5つのツールは、サーバー側で計測された元データに対して課金され、申告された時間で課金されることはありません。ノードは接続された動画または音声の長さを読み取り、クリックする前に正確な価格を表示します。モデルは実際に対応している設定だけを表示します。セレクターが表示されない場合、そのモデルはその項目に対応していないということです。
TextノードでPDFを読み込む
PDFをキャンバスにドロップすると、画像や動画と同じようにMediaノードがそれを受け取ります。それを、文書を読めるモデル(GPT、Claude、Gemini、Kimi K3、Grok 4.6、DeepSeek V4、その他対応表示のあるモデル)に設定したTextノードの「解析する画像またはPDF」ポートに接続します。モデルは文書全体を受け取り、あなたの指示(要約、抜粋、リライト、構成案、イラスト用プロンプトなど)に応答します。
価格は文書のサイズに応じて決まります。ノードはファイルを送信した時点でコストを確保し、実際に読み取られたトークン数に応じて確定します。差額は残高に返還されます。ノードごとに最大3件の文書まで対応します。回答はそのまま後段に接続されたImageノードやVideoノードに渡されます。レポートがカルーセルに、説明書が動画チュートリアルになります。
マイキャラクター
内容がしっかり入力されたReferenceノード(名前、説明、写真)は保存しておく価値があります。「マイキャラクターに保存」ボタンで、それをアカウントに保存できます。他のどのプロジェクトでも、「マイキャラクター」を開くと一覧が表示され、ワンクリックでReferenceノードに名前、説明、画像まで一括入力されます。アカウントごとに最大30体、それぞれ8枚まで画像を登録できます。
編集したキャラクターは、それを読み込んだノードから更新でき、一覧から削除できます。これにより、同じマスコット、同じ司会者、同じ製品を、週をまたいでカードを作り直すことなく使い続けられます。
3D Objectノード
3D Objectノードは画像を3Dファイルに変換します。画像(アップロードした写真、またはImageノードのレンダリング結果)を接続すると、Tripo 2.5またはTrellis 2がテクスチャ付きのGLBを生成します。これはBlender、Unity、Unreal、Webビューアーが読み込める形式です。モデルはノード内に表示され、指またはマウスで回転させて確認し、ダウンロードできます。
続いて、ブラウザ内で無料の2つのレンダリングが生成されます。5秒間のターンテーブル映像(videoポート)と、静止画(imageポート)です。ターンテーブル映像はVideoノード(Wan 3.0またはSeedance 2.5)にリファレンスとして接続すると、オブジェクトの形状を保ちながらシーンに配置できます。静止画は画像を受け付ける箇所ならどこでも接続できます。単色の背景に対象物全体を写したものが最も良いボリュームを得られます。シーンの一部や、フレームで切れている被写体は、仕上がりが劣ります。