خصم 10% على الاشتراك الشهري بالرمز NODE10، حتى 31 أغسطس

Imaginode
كل الأدوات

أفاتار ذكاء اصطناعي يتكلم

مقدّم مولّد ينطق نصك أمام الكاميرا، بصوته. Veo 3.1 يولّد الصورة والكلام معًا، فتقع حركة الشفاه في مكانها الصحيح. مسار العمل معروض هنا، دون إنشاء حساب.

عرض تفاعلي

سير عمل حقيقي بنتائج حقيقية. تنقّل وكبّر بحرية.

استخدام سير العمل هذا

بطاقة المرجع تمسك الوجه، وعقدة النص تحمل السيناريو، وعقدة الفيديو تنتج ثماني ثوانٍ مع الصوت. لا عقدة تعليق صوتي هنا: الكلام يخرج من نموذج الفيديو نفسه. افتح العقد لقراءة الموجّهات.

باختصار

ما ينتجه سير العمل
1 صورة بنسبة 9:16 · 1 فيديو بمدة 8 ثانية بدقة 720p، بنسبة 9:16
بنية لوحة العمل
5 عقدة مرتبطة بـ 2 وصلة
النماذج الموصولة
Seedream 5 Pro, Veo 3.1 Fast
تكلفة تشغيل كامل
نحو 149 رصيد، أي ‏1.49 €

الأفاتار المتكلم يصطدم دائمًا بالمشكلة نفسها: مزامنة الشفاه. السلاسل التقليدية تولّد فيديو صامتًا، ثم تصنع الصوت على حدة، ثم تحاول لصق الاثنين، فيبقى ذلك التأخر بعُشر الثانية الذي يفضح الأمر فورًا.

هنا يخرج الكلام والصورة من التوليد نفسه. Veo 3.1 Fast يولّد الحوار مع الفيديو: الشفاه تتبع الصوت لأنهما حُسبا معًا. في المقابل، تغيير كلمة واحدة يعني إعادة التوليد، لذا يُثبَّت السيناريو قبل الانطلاق، ولهذا يعيش في عقدة نص خاصة به، قابلة للتعديل دون المساس بالشخصية.

أما الوجه فتمسكه بطاقة مرجع بثلاث زوايا، وهي الآلية نفسها المستخدمة في الحفاظ على شخصية متّسقة عبر عدة لقطات. هكذا تنتج سلسلة كاملة بالمقدّم نفسه، حلقة بعد حلقة. Seedream 5 Pro يركّب اللقطة الأولى، والحاسبة العلنية تعطي التكلفة الدقيقة للقطة الواحدة قبل أي تسجيل.

طريقة العمل

  1. 1

    أنشئ المقدّم

    بطاقة المرجع تحمل ثلاث زوايا للوجه. هي التي تتيح استعادة الشخص نفسه تمامًا في الحلقة التالية، بديكور آخر ونص آخر.

  2. 2

    ركّب اللقطة

    عقدة الصورة تؤطّر المشهد: مكتب، إضاءة، مساحة متروكة لنص على الشاشة. لقطة إلى الصدر، مزاحة قليلًا، تترك مجالًا لحركة اليدين.

  3. 3

    اكتب الجملة المنطوقة

    عقدة النص تحوي الإخراج والجملة المطلوب نطقها، بين علامتي تنصيص. جملتان قصيرتان تكفيان لثماني ثوانٍ، وتُوصف النبرة كإرشاد تمثيلي.

  4. 4

    ولّد اللقطة

    ثماني ثوانٍ، صيغة عمودية، صوت مفعّل. الصوت يصل داخل ملف الفيديو: لا شيء يُزامَن بعد ذلك، ولا شيء يُركَّب إن كانت اللقطة جيدة.

الأنماط وحالات الاستخدام

لوحة العمل نفسها، مضبوطة لاحتياجات مختلفة: كل نمط يتطلّب تغيير سطرين أو ثلاثة في الـ prompt.

أفاتار مقدّم لدورة تدريبية

وحدة تدريبية تُقسَّم إلى مقاطع من ثماني ثوانٍ، كل مقطع في عقدة فيديو خاصة به، وكلها موصولة ببطاقة الوجه نفسها. المقدّم يبقى هو نفسه من فصل إلى آخر، وهو ما لا تضمنه أي سلسلة تصوير حقيقية بهذه الكلفة.

متحدث رسمي باسم العلامة

الوجه نفسه يفتتح كل فيديو للشركة، دون اعتماد على توفّر موظف أو بقائه في وظيفته. صف الزي والديكور داخل عقدة الصورة: البطاقة تمسك الوجه، واللقطة تمسك السياق.

أفاتار يتحدث لغة أخرى

اكتب الجملة بين علامتي اقتباس باللغة المطلوبة: Veo 3.1 Fast ينطقها، بحركة الشفاه المطابقة. الفيديو الواحد يتفرّع بذلك إلى خمسة أسواق، بالمقدّم نفسه وخمس جمل مختلفة.

فيديو ترحيب على صفحة موقع

ثماني ثوانٍ، ولقطة من الصدر، وخلفية مكتب ضبابية: هذه هي الصيغة التي ترفع زمن البقاء على الصفحة الرئيسية. أبقِ الجملة قصيرة، وفكرة واحدة لكل فيديو، وخطّط لنص مكتوب للمشاهدة بلا صوت.

أفاتار عمودي لـ TikTok وReels

القالب ينتج أصلًا بنسبة 9:16. اترك هواء فوق الرأس للنص على الشاشة، واقطع نصف الثانية الأولى في المونتاج: نماذج الفيديو تبدأ غالبًا بلقطة شبه جامدة.

أخطاء شائعة

نص أطول من ثماني ثوانٍ

جملتان قصيرتان تدخلان في لقطة واحدة. وبعدهما، يسرّع النموذج الإيقاع أو يقطع النهاية، فتضطر إلى دفع ثمن التوليد كاملًا لتصحيح كلمة واحدة.

وصف الصوت بعد تشغيل التوليد

الصوت يخرج من التوليد نفسه الذي يخرج منه الصورة: النبرة والإيقاع والنيّة تُوصف داخل الموجّه، قبل التشغيل. تغيير الصوت يعني لقطة جديدة كاملة.

لقطة قريبة جدًا من الوجه

اللقطات شديدة القرب تُظهر العيوب الدقيقة حول الفم. لقطة من الصدر، مزاحة قليلًا عن المركز، تترك مجالًا للإيماءات وتجعل الأداء أكثر إقناعًا.

النماذج المقترحة

أسئلة شائعة

هل يمكن اختيار الصوت؟

تصفه في الموجّه كإرشاد اختيار ممثل: طبقة الصوت، وسرعة الإلقاء، والنية. لا يُنتقى من قائمة، وقد يختلف توليدان للنص نفسه اختلافًا طفيفًا.

هل يتكلم النموذج العربية؟

نعم، والقالب يفعل ذلك. اكتب الجملة بالعربية بين علامتي تنصيص داخل الموجّه، ويمكن أن يبقى باقي الوصف بالإنجليزية دون أن يغيّر ذلك لغة النطق.

ماذا أفعل إذا فشلت اللقطة؟

نعيد التوليد. لقطة من ثماني ثوانٍ تكلّف بضع عشرات من السنتات من الرصيد، والعقدة تحتفظ بسجل التوليدات السابقة: لا شيء يضيع عند مقارنة نسختين.

هل مزامنة الشفاه دقيقة؟

نعم، لأن الصورة والكلام يخرجان من التوليد نفسه: لا شيء يُلصَق بعد الإنتاج. وهذا ما يميّز مسار العمل هذا عن السلاسل التقليدية، حيث يكفي فارق عُشر ثانية لفضح التركيب.

هل يمكن استخدام وجهي أنا؟

نعم، بملء بطاقة المرجع بثلاث صور لك. ولا تفعل ذلك إلا بوجه شخص أعطى موافقته: متحدث رسمي مولّد من صور شخص آخر يطرح مشكلة حقيقية في الحق على الصورة.

كم تكلّف لقطة من ثماني ثوانٍ؟

نحو 144 نقطة رصيد مع Veo 3.1 Fast، أي يورو وأربعون سنتًا، بما في ذلك صورة الانطلاق. السعر الدقيق يظهر على الزر قبل تشغيل التوليد.

هل يمكن تسلسل عدة جمل؟

نعم، عقدة فيديو لكل جملة، وكلها موصولة ببطاقة الوجه نفسها وبلقطة الانطلاق نفسها. المونتاج المتتابع يعطي فيديو من دقيقة بمقدّم ثابت.

أفاتار ذكاء اصطناعي يتكلم

استخدام سير العمل هذا

حساب مجاني، دون بطاقة بنكية. يُفتح سير العمل معبّأً مسبقًا في لوحة عملك.