جعل سيناريو يُقرأ بأصوات متعددة بالذكاء الاصطناعي

السيناريو بصيغة PDF يُسحب إلى لوحة العمل: node نص واحد يستخرج منه عشر جمل جاهزة للقراءة، سارد للأحداث الأساسية وشخصيات تنطق كلماتها كما وردت، ثم node صوت في وضع الحوار يؤديها في لقطة واحدة بثلاثة أصوات من ElevenLabs. القراءة التي تقومون بها مع الممثلين، في ثلاث نقرات. سير العمل كاملاً مرئي دون حساب.

السيناريو الأصلي المكوّن من ثلاث مشاهد، ملف PDF مسحوب إلى node الوسائطعرض تفاعلي

سير عمل حقيقي بنتائج حقيقية. تنقّل وكبّر بحرية.

استخدام سير العمل هذا

سير العمل الحقيقي: السيناريو الأصلي المكوّن من ثلاث مشاهد بصيغة PDF في node وسائط، Claude Sonnet 5 لاستخراج العشر جمل، node صوت في وضع الحوار على ElevenLabs Dialogue v3 بثلاثة أصوات. النصوص المعروضة هي إجابات النماذج، دون أي تعديل.

باختصار

ما تقدّمه
1 ملف PDF · نص أو ملخص (بريف)
ما ينتجه سير العمل
تعليق صوتي واحد
بنية لوحة العمل
4 عقدة مرتبطة بـ 1 وصلة
النماذج الموصولة
Claude Sonnet 5, ElevenLabs Dialogue v3
تكلفة تشغيل كامل
نحو 10 رصيد، أي ‏0.12 US$
الحساب
يمكن رؤية العرض التجريبي دون حساب؛ أما التوليد فيتطلب حسابًا مجانيًا، بما في ذلك كريدت تجريبي

الحوار لا يُقيَّم إلا بالأذن. ملف PDF الخاص بالسيناريو يدخل إلى node وسائط، ويقرأه node نص عبر مدخله "صورة أو PDF للتحليل" لاستخراج عشر جمل بصيغة الاسم: النص: سارد يذكر الحدث الأساسي في جملة واحدة، وشخصيات تنطق كلماتها حرفيًا كما في النص.

node الصوت في وضع الحوار يحمل هذه العشر جمل، كل واحدة بصوتها، وElevenLabs Dialogue v3 يؤديها في تمريرة واحدة: التتابع، الصمت، وتبادل الحديث كلها تأتي من النموذج، لا من مونتاج. ثلاثة أصوات في العرض التوضيحي: سارد بصوت عميق، صوت امرأة ناضجة لماران، وصوت شاب لإلياس.

العرض التوضيحي يقرأ المشهدين 2 و3 من "North of Silence"، السيناريو الأصلي لقالب تحويل السيناريو إلى فيلم. عشر جمل لكل node: للمشهد التالي، كرّروا node الصوت وألصقوا فيه العشر جمل التالية، التي كتبها node النص. استبدلوا ملف PDF بسيناريو خاص بكم والأسماء في التعليمات.

نتائج فعلية من العرض التجريبي

هذه هي ملفات مسار العمل أعلاه، كما أنتجتها النماذج تمامًا، دون أي تعديل. تتم الإشارة إلى نقطة البداية عند وجودها.

النتيجة

قراءة المشهدين 2 و3: عشر جمل أُدِّيت في لقطة واحدة بواسطة ElevenLabs Dialogue v3، سارد، ماران وإلياستم إنشاؤه باستخدام ElevenLabs Dialogue v3

لمن هذا مخصص

كتّاب السيناريو، كتّاب المسرح وكتّاب الأعمال الروائية الذين يريدون الاستماع إلى حوار قبل إعادة كتابته أو تسليمه لممثلين لقراءته.

أي ملفات يجب تقديمها

سيناريو أو فصل بصيغة PDF نصي: الأسماء بحروف كبيرة والعناوين الفرعية للمشاهد تساعد على فصل الأحداث عن الجمل.

طريقة العمل

  1. 1

    اسحبوا السيناريو بصيغة PDF

    يستقبله node وسائط. يُفضَّل تنسيق السيناريو الكلاسيكي: الأسماء بحروف كبيرة والعناوين الفرعية للمشاهد تساعد النموذج على فصل الأحداث عن الجمل.

  2. 2

    اتركوا node النص يكتب الجمل

    عشرة أسطر بصيغة الاسم: النص، مع ذكر المشاهد المطلوب قراءتها وأسماء شخصياتكم في التعليمات. NARRATOR يلخص الحدث، والشخصيات تنطق كلماتها حرفيًا.

  3. 3

    ألصقوا الجمل في node الصوت

    node الصوت في وضع الحوار له أسطره الخاصة: جملة واحدة لكل سطر، وصوت واحد لكل شخصية يُختار من القائمة. عشرة أسطر لكل node؛ node ثانٍ للمشهد التالي.

  4. 4

    استمعوا، ثم عدّلوا

    لقطة واحدة تؤدي كل التبادل. جملة تبدو باهتة: أضيفوا وسم أداء، [sighs] أو [whispers]، في النص. صوت لا يناسب: غيّروه في السطر، لا في كامل node.

الأنماط وحالات الاستخدام

لوحة العمل نفسها، مضبوطة لاحتياجات مختلفة: كل نمط يتطلّب تغيير سطرين أو ثلاثة في الـ prompt.

قراءة مشهد حواري

هذا هو العرض التوضيحي: عشر جمل، شخصيتان وسارد، لقطة واحدة. لمشهد أطول، node صوت مضاعفان بعشر جمل كل واحد، متتاليان في node مونتاج.

قراءة رواية بأصوات متعددة

فصل من رواية بصيغة PDF يصلح أيضًا: السارد يقرأ النثر، والشخصيات تقرأ الحوارات بين علامات التنصيص. اطلبوا من node النص الحفاظ على الجمل بحرفيتها.

دبلجة قصة رسومية

فقاعات صفحة، واحدة لكل سطر مع اسم الشخصية: node الصوت يؤدي الصفحة، وnode مونتاج يعرضها على الشاشة مع الصوت.

اختبار توزيع الأصوات

كرّروا node الصوت وغيّروا فقط صوت شخصية واحدة في كل نسخة: ثلاث لقطات، ثلاث نبرات، والمقارنة تتم بالأذن في دقيقة واحدة.

القراءة بلغة أخرى

اطلبوا من node النص ترجمة الجمل وضبط لغة node الصوت: ElevenLabs Dialogue يؤدي أربع عشرة لغة، بنفس الأصوات.

أخطاء شائعة

أكثر من عشر جمل في node واحد

وضع الحوار يستوعب عشر أسطر لكل لقطة. مشهد من ثلاثين جملة يعني ثلاثة nodes صوت، مرتبطة في node مونتاج بنصف ثانية صمت بين اللقطات.

صوتان متقاربان جدًا

نبرتان متشابهتان تُسمعان كمونولوج. اختاروا صوتًا عميقًا وصوتًا واضحًا، أو امرأة ورجلًا، قبل البحث عن فروق أدق.

الإرشادات المسرحية تُقرأ بصوت عالٍ

على السارد أن يذكر الحدث في جملة واحدة، لا ملاحظات السيناريو بين الأقواس. تعليمات node النص تطلب ذلك: تحققوا من العشر جمل قبل اللصق.

النماذج المقترحة

أسئلة شائعة

لماذا نلصق الجمل في node الصوت؟

لأن وضع الحوار يحمل أسطره بصوت واحد لكل منها، عشرة على الأكثر لكل لقطة: هذا ما يؤديه النموذج في تمريرة واحدة. node النص يحضّرها بالتنسيق الصحيح، واللصق يستغرق عشر ثوانٍ.

كم صوتًا يمكن الدمج بينها؟

نحو عشرين نبرة من ElevenLabs، بعدد الشخصيات في العشر جمل. ثلاثة في العرض التوضيحي: السارد، ماران، إلياس. الأصوات ذات النبرات المتباينة تُميَّز أفضل من مونولوج.

كم تكلف القراءة؟

نحو عشرة أرصدة لعشر جمل: قراءة PDF بواسطة Claude Sonnet 5 والحوار على ElevenLabs، تُحسب بالحرف. السعر يظهر على node قبل النقر.

هل يمكن استخدام صوتي الخاص؟

نعم: صوت مستنسخ من مكتبتكم يُختار في سطر كأي نبرة أخرى. استنسخوا الصوت أولًا في node تعليق صوتي، ثم اسندوه إلى الشخصية.

هل الصمت قابل للضبط؟

النموذج يضع فترات التنفس بنفسه. لصمت حقيقي، قسّموا القراءة إلى نودين وأتركوا ثانية بينهما في المونتاج.

ما اللغة المستخدمة في القراءة؟

لغة الجمل، المضبوطة على node الصوت: الإنجليزية في العرض التوضيحي، مع توفر أربع عشرة لغة. سيناريو بالفرنسية يُقرأ بالفرنسية، بنفس الأصوات.

هل يمكن تصدير القراءة كفيديو؟

نعم: node مونتاج بغلاف أو صورة من المشهد كمقطع، والقراءة على المسار الصوتي، يصدّر ملف mp4 لشبكات التواصل أو ملف إنتاج.

جعل سيناريو يُقرأ بأصوات متعددة بالذكاء الاصطناعي

استخدام سير العمل هذا

حساب مجاني، دون بطاقة بنكية. يُفتح سير العمل معبّأً مسبقًا في لوحة عملك.