فيديو «في هذه اللحظة، في مخيّلتيهما»
قطتاك نائمتان على الأريكة، ثم تظهر عبارة «في هذه اللحظة، في مخيّلتيهما» تليها جلسة التراب: تركيب اللقطتين تباعًا يمنح الصيغة المنتشرة على TikTok وInstagram.
تتحول صورتا قطتيك إلى جلسة حية: وجهًا لوجه عند الميكروفون المعلّق، تُغنّيان الراب بالإنجليزية على إيقاع تراب، مع الصوت. سير العمل معروض هنا، دون حساب.
سير عمل حقيقي: قطة رمادية وبيضاء وقطة سوداء تدخلان إلى صورة واحدة، وجهًا لوجه عند الميكروفون المعلّق في استوديو أزرق بترولي، ثم عشر ثوانٍ من Seedance 2.5 مع الصوت: إيقاع تراب وسطر واحد تُغنّيه كل قطة بالإنجليزية.
باختصار
الجلسات الحية المصوَّرة أمام جدار بلون واحد، مع ميكروفون معلّق في الوسط، يُعاد تصويرها الآن مع قطط تُغنّي الراب، وهذه الفيديوهات منتشرة في كل مكان. يصنع هذا سير العمل فيديوك الخاص انطلاقًا من صورتَي قطتيك.
النقطة الصعبة هي الحفاظ على قطتيك كما هما. تدخل الصورتان إلى صورة واحدة تضعهما وجهًا لوجه مع نقل فرائهما وبقعهما وعينيهما بدقة؛ ثم ينطلق الفيديو من هذه الصورة دون إعادة رسم أي شيء، وهو من يضيف الإيقاع والأصوات.
يُنتج Seedance 2.5 الحركة وإيقاع التراب والصوتين المُغنّيين في تمريرة واحدة، بالإنجليزية، مع تزامن حركة الفم مع الكلمات. الصورة وعشر ثوانٍ من الفيديو تكلّفان مئتين وتسعة وخمسين رصيدًا.
هذه هي ملفات مسار العمل أعلاه، كما أنتجتها النماذج تمامًا، دون أي تعديل. تتم الإشارة إلى نقطة البداية عند وجودها.
نقطة البداية
النتيجة
أصحاب القطط الذين ينشرون على TikTok وInstagram، صانعو المحتوى المتابعون للترندات، الملاجئ، ماركات منتجات الحيوانات، والفنانون.
صورتان لقطتيك من الأمام، في ضوء النهار، بالإضافة إلى سطر راب بالإنجليزية لكل واحدة منهما.
أضف صورتين واضحتين
كل قطة من الأمام، في ضوء النهار، مع ظهور واضح للفراء والعينين. القطتان المتشابهتان جدًا قد تختلطان: إذا كانت لديك قطتان مخططتان، صف في التعليمة ما يميّز كلًا منهما.
اختر لون الجدار
لون واحد مشبّع، يمتزج فيه الجدار بالأرض: أزرق بترولي هنا، لكن البرتقالي والأصفر والوردي تصلح أيضًا. هذه الخلفية الموحّدة تجعل هذه الصيغة تُعرف من النظرة الأولى.
تحقّق من الصورة قبل الفيديو
الفراءان، الميكروفون بين الفمين، الإطار الضيق: كل هذا يُقيَّم على الصورة بتسعة عشر رصيدًا، قبل دفع تكلفة الفيديو الذي ينطلق منها كما هي.
اكتب سطرًا لكل قطة
سطر قصير بالإنجليزية بين علامتَي اقتباس لكل قطة، وترتيب من تبدأ. عشر ثوانٍ تكفي لسطرين من الراب، لا لكوبليه كامل.
لوحة العمل نفسها، مضبوطة لاحتياجات مختلفة: كل نمط يتطلّب تغيير سطرين أو ثلاثة في الـ prompt.
قطتاك نائمتان على الأريكة، ثم تظهر عبارة «في هذه اللحظة، في مخيّلتيهما» تليها جلسة التراب: تركيب اللقطتين تباعًا يمنح الصيغة المنتشرة على TikTok وInstagram.
قطعة موسيقية لكل فيديو ولون جدار لكل حلقة: تتحول قطتاك إلى الثنائي المتكرر لحساب ما، يمكن تمييزهما بفرائهما من فيديو إلى آخر.
صور قطط صديق، ويصل الفيديو يوم عيد ميلاده: اسمه ضمن سطر من الراب، عشر ثوانٍ تُحدث أثرًا أكبر من رسالة وتُشارك في المجموعة.
قطتان معروضتان للتبنّي معًا في جلسة تراب، وأسماؤهما ضمن الكلمات: يُشارَك الفيديو أكثر بكثير من بطاقة تبنّي، ويُظهر أنهما ثنائي متلازم.
تُبرز ماركة للأعلاف أو الفرشة قطط أحد العملاء بموافقته: يبدو الفيديو كأنه جزء من الترند الحالي، لا كإعلان، ويجعل المتابعين يرغبون في إرسال صور قططهم.
مغني راب يُصدر أغنية جديدة يجعل قططه تُغنّي السطر الحقيقي من اللحن الأساسي: عشر ثوانٍ غريبة تجذب الأنظار وتوجّه إلى الأغنية الكاملة.
من دون الجملة التي تحظره، يعود النموذج إلى صرخة القطة عوضًا عن صوت مغني الراب. احتفظ بعبارتَي «دون أي مواء على الإطلاق» و«صوتان بشريان حقيقيان لمغنيي راب» في التعليمة.
يخمّن النموذج في هذه الحالة الفراء، فيصبح المغنّيان قطتين عاديتين بلا ملامح خاصة. الصور من الأمام، في ضوء النهار، تحافظ على البقع ولون العينين.
عشر ثوانٍ تكفي لسطرين من الراب فقط. أما الكوبليه الكامل فيُنطق بسرعة زائدة أو يُقطع في وسطه، ويتأثر تزامن حركة الفم سلبًا.
ينطلق الفيديو من الصورة كما هي: أي قطة صغيرة جدًا أو ميكروفون في وضعية خاطئة يبقيان لعشر ثوانٍ كاملة. أعد توليد الصورة، فتكلفتها أقل بكثير.
لأنها لغة الفيديوهات المنتشرة، ولأن الراب بالإنجليزية يتناسب صوتيًا مع إيقاع التراب. يُغنّي النموذج الكلمات المكتوبة بين علامتَي اقتباس: غيّرها كما يحلو لك، مع الحفاظ على أسطر قصيرة.
نعم: احذف عقدة الوسائط الثانية، وأعد كتابة التعليمة لقطة واحدة عند الميكروفون تُغنّي السطرين. لثنائي معك، راجع الثنائي مع قطة عملاقة.
نعم، استبدل كلمة «قطة» بكلمة «كلب» في التعليمتين. تحافظ الصورة على لون شعر ورأس الحيوانات في الصور، وتحافظ التعليمة على أصوات مغنيي الراب.
مئتان وتسعة وخمسون رصيدًا: تسعة عشر للصورة على Nano Banana Pro، ومئتان وأربعون لعشر ثوانٍ من Seedance 2.5 بدقة 720p مع الصوت. صورة جديدة بمفردها تكلّف تسعة عشر رصيدًا.
بالمقارنة في العرض التجريبي مع Wan 3.0، انطلاقًا من الصورة نفسها: كلاهما يُغنّي الكلمات الصحيحة على إيقاع تراب حقيقي، لكن Wan 3.0 قطع إلى لقطة قريبة في الوسط، في حين يحافظ Seedance 2.5 على اللقطة من البداية إلى النهاية، مع القطتين معًا عند الميكروفون. يمكن ربط Wan 3.0 بدلًا منه بنصف التكلفة.
نعم، حتى ثلاثين ثانية، بنفس السعر للثانية. في هذه الحالة، اكتب أربعة أسطر وحدّد ترتيب الغناء، حتى تحصل كل قطة على لحظتها عند الميكروفون.
ينتج القالب فيديو عمودي بنسبة 9:16، بملء الشاشة على الهاتف. للحصول على النسخة الأفقية للفيديوهات الأصلية، غيّر نسبة الصورة إلى 16:9: يعتمد الفيديو نفس النسبة.
نعم، فهما قطتاك وموسيقى مؤلَّفة بواسطة النموذج. أشِر إلى أن المحتوى مُولَّد بالذكاء الاصطناعي عندما تطلب الشبكة ذلك، وهو خيار متاح على TikTok وInstagram.
جعل قططك تُغنّي الراب على إيقاع تراب بالذكاء الاصطناعي
استخدام سير العمل هذاحساب مجاني، دون بطاقة بنكية. يُفتح سير العمل معبّأً مسبقًا في لوحة عملك.