एक उपन्यास का ट्रेलर
यही डेमो है: चार शॉट, चार वाक्यों का वॉइस-ओवर, एक संगीत परत। PDF को अपने पहले चैप्टर से बदलें, वॉइस-ओवर की निर्देश में अपना शीर्षक डालें, और शॉट के संकेत (जगह, किरदार, अजनबी, तूफ़ान) रखें या अपनी कहानी के लिए फिर से लिखें।
कैनवस पर डाला गया PDF में एक चैप्टर या सिनॉप्सिस: एक Text node वॉइस-ओवर लिखता है, चार और नोड्स हर एक अलग शॉट लिखते हैं, शॉट्स पहले बनते हैं फिर सात सेकंड में एनिमेट होते हैं, एक आवाज़ उन्हें पढ़ती है, एक संगीत परत उन्हें सहारा देती है, और मॉन्टाज तीस सेकंड का ट्रेलर जोड़कर तैयार करता है। डेमो एक मूल चैप्टर से शुरू होता है। पूरा वर्कफ़्लो बिना अकाउंट के देखा जा सकता है।
असली वर्कफ़्लो: एक Media node में PDF के रूप में उपन्यास का पहला चैप्टर, वॉइस-ओवर और चार शॉट्स के लिए Claude Sonnet 5, पहली फ़्रेम्स के लिए Nano Banana Pro, चार सात-सेकंड वीडियो के लिए Wan 3.0, आवाज़ के लिए ElevenLabs v3, संगीत परत के लिए ElevenLabs Music, और एक Montage node। दिखाए गए टेक्स्ट मॉडलों के जवाब हैं, बिना किसी बदलाव के।
एक नज़र में
एक बुक ट्रेलर तीस सेकंड में समा जाता है: एक जगह, एक किरदार, एक खतरा, एक शीर्षक। आपके चैप्टर या सिनॉप्सिस का PDF एक Media node में जाता है, और पाँच Text nodes उसे अपने "विश्लेषण के लिए इमेज या PDF" पोर्ट के ज़रिए पढ़ते हैं। पहला नोड वॉइस-ओवर को चार वाक्यों में लिखता है, आखिरी वाक्य शीर्षक पर होता है। बाकी चार नोड्स हर एक सात-सेकंड का शॉट लिखते हैं, ऊपर एक जैसे स्टाइल ब्लॉक के साथ: यही ट्रेलर को एक जैसी रोशनी और एक जैसा टेक्स्चर देता है।
हर शॉट पहले Nano Banana Pro पर एक फ़्रेम बनता है, फिर Wan 3.0 पर बिना आवाज़ के सात-सेकंड का वीडियो बनता है: आवाज़ और संगीत मॉन्टाज के ज़रिए आते हैं। Voice-over node चार वाक्यों को ElevenLabs v3 से पढ़ता है, Music node एक जुड़े हुए ब्रीफ़ से तीस सेकंड की संगीत परत बनाता है। Montage चार शॉट्स को क्रम में जोड़ता है, शुरुआत के आधे सेकंड बाद आवाज़ रखता है और संगीत को कम आवाज़ में।
डेमो "North of Silence" से शुरू होता है, जो उदाहरण के लिए लिखे गए एक मूल उपन्यास का पहला चैप्टर है: एक लाइटहाउस की रखवाली करने वाली महिला, लैंप बंद करने आया एक अधिकारी, एक तूफ़ान। PDF को अपने वाले से बदल दें, वॉइस-ओवर की निर्देश में अपना शीर्षक रखें, बाकी सब खुद-ब-खुद हो जाता है। एक और शॉट का मतलब है नोड्स की एक और पंक्ति। पूरा काम लगभग 350 क्रेडिट का पड़ता है, जिसमें वीडियो दो-तिहाई हिस्सा लेते हैं।
ये ऊपर वाले वर्कफ़्लो की फ़ाइलें हैं, ठीक वैसी ही जैसी मॉडलों ने बनाई, बिना किसी सुधार के। जहाँ शुरुआती बिंदु मौजूद है, वहाँ उसे दिखाया गया है।
रेंडर
वे लेखक और प्रकाशक जो किताब के लॉन्च के लिए बिना शूटिंग के तीस सेकंड का वीडियो चाहते हैं।
टेक्स्ट PDF में एक चैप्टर या सिनॉप्सिस, दो पेज काफ़ी हैं: मॉडल पूरा दस्तावेज़ पढ़ते हैं और उससे जगह, किरदार और दांव निकाल लेते हैं।
चैप्टर या सिनॉप्सिस का PDF डालें
एक Media node उसे प्राप्त करता है। एक ट्रेलर के लिए एक चैप्टर काफ़ी है, एक पेज का सिनॉप्सिस भी: मॉडल पूरा दस्तावेज़ पढ़ते हैं और उससे जगह, किरदार और दांव निकाल लेते हैं।
Text nodes को वॉइस-ओवर और शॉट्स लिखने दें
पाँच नोड्स PDF पढ़ते हैं। पहला वॉइस-ओवर के चार वाक्य लिखता है; बाकी चार हर एक साझा स्टाइल, सेट या किरदार, रोशनी, और एक कैमरा मूवमेंट के साथ शॉट लिखते हैं। अपनी किताब के लिए शीर्षक और शॉट के संकेत निर्देशों में बदल दें।
पहले फ़्रेम्स फिर वीडियो जनरेट करें
हर शॉट का अपना Image node होता है, फिर सात सेकंड पर सेट, बिना आवाज़ का Video node। एनिमेट करने से पहले चार तस्वीरें देख लें: यही वो जगह है जहाँ किसी सेट या किरदार को दो क्रेडिट में सुधारा जाता है, बाद में नहीं।
आवाज़ पढ़ें और संगीत परत बनाएँ
Voice-over node केबल से टेक्स्ट पाता है और सूची से चुनी गई आवाज़ में उसे पढ़ता है। Music node जुड़े हुए ब्रीफ़ से तीस सेकंड बनाता है, डिफ़ॉल्ट रूप से केवल संगीतमय। दोनों Montage में अपने-अपने ट्रैक पर पहुँचते हैं।
एडिट करें और एक्सपोर्ट करें
चार शॉट्स केबल के क्रम में एक के बाद एक चलते हैं, आवाज़ शुरुआत के आधे सेकंड बाद शुरू होती है, संगीत धीमा रहता है और फ़ेड होकर बंद हो जाता है। मॉन्टाज ब्राउज़र में ही रेंडर होता है, बिना कोई क्रेडिट लिए, और सोशल नेटवर्क तथा किताब के पेज के लिए mp4 में एक्सपोर्ट होता है।
वही कैनवास, अलग-अलग ज़रूरतों के लिए सेट किया हुआ: हर वेरिएंट में प्रॉम्प्ट की बस दो-तीन लाइनें बदलनी होती हैं।
यही डेमो है: चार शॉट, चार वाक्यों का वॉइस-ओवर, एक संगीत परत। PDF को अपने पहले चैप्टर से बदलें, वॉइस-ओवर की निर्देश में अपना शीर्षक डालें, और शॉट के संकेत (जगह, किरदार, अजनबी, तूफ़ान) रखें या अपनी कहानी के लिए फिर से लिखें।
कोई किरदार नहीं: चार शॉट नोड्स से स्थिति की तस्वीरें माँगें (समस्या, हरकत, नतीजा, मेज़ पर रखी किताब) और वॉइस-ओवर से तीन तीखे सवाल फिर शीर्षक। यही ग्राफ़ नॉन-फ़िक्शन का टीज़र बना देता है।
चार Image और Video nodes को 9:16 में बदलें और Montage को भी 9:16 में: वही शॉट्स स्टोरीज़ और शॉर्ट्स के लिए फिर से फ्रेम हो जाते हैं। पहले तस्वीरें जनरेट करें, चौड़े फ्रेम वाला सेट हमेशा वर्टिकल में सही नहीं दिखता।
हर शॉट के लिए नोड्स की एक पंक्ति: पाँचवें शॉट के लिए आखिरी वाली को डुप्लिकेट करें, बीस-सेकंड के टीज़र के लिए एक हटा दें। Montage केबलों का पालन करता है, वॉइस-ओवर को अंतिम शॉट्स की संख्या के अनुसार लिखना ज़रूरी है।
पहले मैनुस्क्रिप्ट से किरदारों की शीट्स जनरेट करें, फिर उन्हें शॉट के Image nodes के इमेज पोर्ट से जोड़ें: चेहरे एक शॉट से दूसरे शॉट में वैसे ही बने रहते हैं, जैसे फ़िल्म वाले टेम्पलेट में।
चारों निर्देशों में ऊपर वही स्टाइल ब्लॉक दोहराया जाना चाहिए: फिल्म स्टॉक, पैलेट, ग्रेन। इस ब्लॉक के बिना कोई शॉट अलग रोशनी में चला जाता है और ट्रेलर चार अलग-अलग फ़िल्मों से जुड़ा हुआ लगता है।
सात-सेकंड के चार शॉट मिलकर अट्ठाईस सेकंड बनते हैं; पचपन शब्दों से ज़्यादा का वॉइस-ओवर समय से बाहर निकल जाता है और Montage उसे काट देता है। चालीस से पचपन शब्द माँगें, हर शॉट के लिए एक वाक्य।
Video nodes बिना साउंड के सेट होते हैं: आवाज़ और संगीत Montage के ट्रैक्स से आते हैं। शॉट्स का ऑडियो फिर से चालू करने से माहौल की आवाज़ें एक-दूसरे पर चढ़ जाती हैं और आवाज़ दब जाती है। अगर आपको जगह की आवाज़ चाहिए, तो संगीत परत को कम कर दें।
डेमो के लिए लगभग 350 क्रेडिट: Wan 3.0 पर 720p में चार सात-सेकंड वीडियो (लगभग 60 क्रेडिट प्रत्येक), चार पहली फ़्रेम्स (लगभग दस-दस), तीस सेकंड की संगीत परत (लगभग पचास), वॉइस-ओवर और PDF पढ़ना (कुछ ही क्रेडिट)। कीमत क्लिक करने से पहले हर नोड पर दिखाई जाती है।
हाँ: Voice-over node की निर्देश को "चैप्टर के तीन वाक्य लिखो जो आगे पढ़ने का मन कर दें" से बदल दें। आवाज़ वही पढ़ती है जो उसे केबल से भेजा जाता है। स्क्रीन पर टेक्स्ट कार्ड्स के लिए, GPT Image 2.5 Flare पर Image nodes जोड़ें, जो इमेज के भीतर एक छोटा शीर्षक लिख देता है।
Text node की निर्देश में मांगी गई भाषा में, डेमो में अंग्रेज़ी। ElevenLabs v3 चौदह भाषाएँ पढ़ सकता है: निर्देश अपनी भाषा में लिखें और वह आवाज़ चुनें जो उसे अच्छी तरह बोलती हो।
दोनों काम करते हैं। एक चैप्टर सटीक तस्वीरें और उद्धृत करने योग्य वाक्य देता है; एक सिनॉप्सिस पूरा आर्क देता है, जो दांव बताने वाले टीज़र के लिए उपयोगी है। दो पेज का PDF काफ़ी है।
हाँ, Voice-over node की सूची में: लगभग बीस ElevenLabs v3 आवाज़ें, या आपकी लाइब्रेरी से क्लोन की गई कोई आवाज़। डेमो में Daniel का उपयोग किया गया है, जो एक गहरी आवाज़ वाला नैरेटर है।
GPT Image 2.5 Flare पर एक Image node जोड़ें और शीर्षक को प्रॉम्प्ट के रूप में डालें, फिर उसे Montage के आखिरी क्लिप के रूप में रखें, तीन सेकंड के लिए, एक फ़ेड के साथ। Flare बिना बिगाड़े एक छोटा शीर्षक लिख देता है।
यह जुड़े हुए ब्रीफ़ के आधार पर ElevenLabs Music द्वारा आपके लिए ही बनाया जाता है, डिफ़ॉल्ट रूप से केवल संगीतमय: कोई मौजूदा गाना नहीं, कोई लाइसेंस माँगने की ज़रूरत नहीं। दूसरे रंग के लिए ब्रीफ़ बदल दें।
AI से किताब का ट्रेलर बनाएँ
यह वर्कफ़्लो इस्तेमाल करेंमुफ़्त अकाउंट, बिना क्रेडिट कार्ड। वर्कफ़्लो आपके कैनवास में पहले से भरा हुआ खुलता है।