AIで写真を歌わせる

古い写真でも修復してから10秒間歌わせます:声、歌詞、音楽、リップシンクをすべて1本の動画に。ワークフローはここで確認できます、アカウント登録不要です。

60年代のモノクロ家族写真、角が傷んで折れているインタラクティブデモ

本物のワークフロー、本物の結果。自由に移動・ズームできます。

このワークフローを使う

実際のワークフロー:60年代のモノクロ家族写真を修復・カラー化し、その後おばあちゃんがバラードの4行を歌う10秒間、背後には優しいピアノの音。

概要

ご用意いただくもの
写真1枚 · テキストまたはブリーフ
ワークフローの成果物
画像1枚(3:4) · 動画1本(10秒・720p・3:4)
キャンバスの構成
6個のノードを4本の接続でつないだ構成
使用モデル
Nano Banana Pro, Wan 3.0
1回のフル実行のコスト
約139クレジット($1.67)
アカウント
デモはアカウントなしでご覧いただけます。生成には無料アカウントが必要です(試用クレジット付き)

写真を歌わせるのはSNSのトレンドであり、誕生日に涙を誘うギフトでもあります。古い写真のおばあちゃんが優しい歌を歌ったり、セルフィーの友人がハッピーバースデーを歌ったり。このワークフローは写真を修復し、10秒間歌わせます、声とリップシンクも同期します。

Wan 3.0は声、伴奏、そして一語一語に合わせた口の動きをすべて一度に生成します:歌を作ってから同期する必要はありません。修復を先に行うのは、傷のある写真では顔の動きとともに傷も動いてしまうためです。歌詞は短く、オリジナルのものを引用符で指定します。

声で写真を話させたい場合は写真を話させるを、1曲まるごと作りたい場合は歌を作るをご覧ください。修復と10秒間の歌唱で139クレジットかかります。

デモの実際のレンダリング結果

これらは上記ワークフローの生成ファイルであり、モデルが出力したものをそのまま、加工なしで掲載しています。出発点がある場合はそれも表示しています。

出発点

古い写真

レンダリング結果

修復・カラー化された写真、同じ顔と同じ表情Nano Banana Proで生成
歌う10秒間:ピアノに合わせた4行、リップシンクも同期Wan 3.0で生成

対象となる方

古い写真でも最近の写真でも、ポートレートを歌わせたい家族、コンテンツクリエイター、パーティー主催者の方々。

ご用意いただくファイル

口が見える鮮明な正面ポートレートと、オリジナルの歌詞4行。

手順

  1. 1

    正面のポートレートを選びましょう

    顔全体がはっきり写り、口が見えているもの。古い写真でもよく機能しますが、横顔の写真はあまり向きません。

  2. 2

    まず写真を修復しましょう

    傷、折れ目、色あせを取り除き、当時の自然な色合いに。顔、表情、フレーミングはそのまま保たれます。

  3. 3

    短い歌詞を書きましょう

    10秒間なら引用符付きで4行。スタイル、声、伴奏を指定してください:ピアノのバラード、アルトの声、など。

  4. 4

    カメラは固定しましょう

    フレームが動かない状態でポートレートが歌います。ズームやトラッキングショットはリップシンクを崩してしまいます。

バリエーションと活用例

同じキャンバスを、別の用途に合わせて調整。各バリエーションは、プロンプトを2〜3行変えるだけです。

誕生日のサプライズ

おじいちゃんや友人の写真が、その人のために書かれた歌詞でハッピーバースデーを歌います。パーティー中に上映したり、当日の朝メッセージで送ったりできます。

大切な人への思い出

修復・カラー化された家族写真の中で、おばあちゃんが再び歌います。公開前に、まず家族と共有したい動画です。

SNSのトレンド

古い写真が歌う様子を1話ごとに紹介する、TikTok、Reels、Shortsシリーズ向けの短尺フォーマット:反応を呼び、すぐに認識される形式です。

アニメーション付きの案内状やカード

新婚夫婦や新しく親になった人が、写真の中で短いお知らせを歌います:結婚式の日付や赤ちゃんの名前など、従来の案内状の代わりに送れます。

地域の歴史

村や博物館のアーカイブ写真が、展示のために書かれた当時の歌を歌い、来場者に画面の前で過去の音を聞かせます。

ユーモアのあるギフト

社員証の写真の中で同僚が、送別会のために書かれたバラードを歌います:チーム全員を笑わせるギフトです。

よくある失敗

傷をそのまま残す

傷んだ写真では、歌っている間に顔の動きとともに傷やシミも動いてしまいます。先に修復してください。

歌詞が多すぎる

10秒間に8行では詰め込みすぎて口の動きがずれてしまいます。短い4行で十分です。

著作権のある楽曲を使い回す

有名な楽曲の歌詞は権利なしに再利用できません。自分自身の歌詞を書いてください。

同意なしに誰かを歌わせる

存命の方の写真を歌わせる場合は、特に公開前に本人の同意を得てから行ってください。

おすすめモデル

よくある質問

日本語で歌わせることはできますか?

はい:歌詞を日本語で引用符に入れて書いてください。Wan 3.0は複数の言語で歌えます、短くシンプルな歌詞にしてください。

実際の楽曲を使えますか?

著作権のある楽曲の歌詞は使えません。オリジナルの歌詞を書いてください、あるいはTextノードに書かせてください。

10秒より長くできますか?

はい、Wan 3.0では最大30秒まで可能で、長さに応じた料金がかかります。15秒を超える場合は2つの節に分けてください。

デモの料金はいくらですか?

139クレジットです:Nano Banana Proでの修復に19クレジット、720pで音声付きのWan 3.0による10秒間の生成に120クレジットです。

なぜリップシンクを使わないのですか?

Wan 3.0は声、音楽、口の動きを1つのステップで同時に生成します。リップシンクの場合はまず歌を用意してから、さらに2回目の処理が必要になります。

写真の修復は必須ですか?

傷んだ写真であれば必要です。最近の鮮明な写真であれば、ケーブルを切って写真を直接Videoノードに接続してください。

声を選べますか?

指示文で説明してください:温かみのあるアルト、低いバリトン、軽やかな声、など。Wan 3.0では音声のリファレンスを指定することもできます。

カラー写真の場合はどうなりますか?

はい、同じ手順で問題ありません:すでにカラーの写真であれば、修復はカラー化せずに写真をきれいにするだけです。

AIで写真を歌わせる

このワークフローを使う

無料アカウント、クレジットカード不要。ワークフローは入力済みの状態でキャンバスに開きます。