ब्लॉग

15 सितंबर 2026

AI वीडियो के लिए 3D previz: जनरेट करने से पहले अपना शॉट ब्लॉक करें, पूरी विधि

AI फ़िल्ममेकर दस असफल प्रॉम्प्ट से एक बार सेट की गई 3D सीन की ओर क्यों बढ़ रहे हैं, Seedance, Kling या Wan को चलाने के लिए एक previz को क्या तैयार करना चाहिए, और इसे बिना किसी 3D सॉफ़्टवेयर के, ब्राउज़र में, चंद सेंट में कैसे किया जाए।

Frank Houbre

Frank HoubreImaginode के संस्थापक

वह समस्या जिसे हर कोई जानता है: जनरेटर आपका शॉट देख नहीं पाता

वीडियो जनरेटर कैमरा मूवमेंट तभी समझता है जब उसे दिखाया जाए, तब नहीं जब उसे लिखकर बताया जाए। 3D previz वही चीज़ बनाती है जो उसे दिखानी ज़रूरी है।

आपके दिमाग़ में शॉट पहले से मौजूद है। एक निचला ट्रैकिंग शॉट जो गलियारे में एक किरदार का पीछा करता है, कैमरा ऊपर उठता है जैसे ही वह दरवाज़ा खोलता है, अंदर आती रोशनी। आप यह सब प्रॉम्प्ट में लिख देते हैं, चलाते हैं, और मॉडल आपको बीच में जमा हुआ कैमरा, लेंस की ओर चलता एक किरदार और एक ग़ायब हो चुका दरवाज़ा दे देता है। दूसरा प्रयास, तीसरा, दसवाँ। हर प्रयास पर 20 से 60 क्रेडिट खर्च होते हैं, और फिर भी इस बात की कोई गारंटी नहीं कि ग्यारहवाँ प्रयास सही होगा।

यह शब्दावली की समस्या नहीं है। Seedance 2.5, Kling V3 या Wan 3.0 जैसे वीडियो मॉडल "ट्रैकिंग शॉट", "लो एंगल" या "35 mm" जैसे शब्दों को बख़ूबी समझते हैं। समस्या यह है कि ये शब्द असंख्य संभावित शॉट्स को दर्शाते हैं, और मॉडल इनमें से एक को यूँ ही चुन लेता है। जो चीज़ इस अस्पष्टता को दूर करती है, वह है एक प्रारंभिक फ़्रेम, एक अंतिम फ़्रेम, और जब मॉडल इसे स्वीकार करे, तो मूवमेंट का एक संदर्भ वीडियो।

यही वह चीज़ है जो एक previz तैयार करती है: आपके शॉट का ग्रे, सरलीकृत संस्करण, जिसमें असली वॉल्यूम, असली मैनक्विन किरदार और असली कैमरा हो, जिसे आप एक बार सेट करते हैं और जो उसके बाद की हर जनरेशन का संदर्भ बनता है। सिनेमा तीस साल से शूटिंग से पहले यही करता आ रहा है। AI वीडियो को अभी पता चला है कि उसे इसकी और भी ज़्यादा ज़रूरत है।

previz क्या है, और क्या नहीं है

previz कोई तैयार 3D रेंडर नहीं है: यह एक ब्लॉकिंग है, सही जगह पर रखे साधारण वॉल्यूम, जिन्हें सही मानों वाले कैमरे से फ़िल्माया गया हो।

पारंपरिक प्रोडक्शन में, प्रीविज़ुअलाइज़ेशन (सबके लिए previz) वह चरण है जहाँ शूटिंग से पहले शॉट को 3D में बनाया जाता है। कोई टेक्सचर नहीं, कोई अभिनेता नहीं, कोई विस्तृत सेट नहीं: दीवारों के लिए बॉक्स, खंभों के लिए सिलिंडर, कलाकारों के लिए मैनक्विन। जो मायने रखता है वह कहीं और है: कैमरा कहाँ है, कौन-सा लेंस, किस ऊँचाई पर, कौन-सा मूवमेंट, किस गति से, और फ्रेम में हर सेकंड कौन कहाँ खड़ा है।

previz में जो कुछ भी ग्रे है, वह जान-बूझकर ग्रे है। जिस दिन आप टेक्सचर डालते हैं, आप फ्रेमिंग की बजाय टेक्सचर पर बात करने लगते हैं। previz का मक़सद स्टेजिंग से जुड़े सवालों को सुलझाना है, और यह उन्हें तब बेहतर सुलझाती है जब यह अभी फ़िल्म जैसी नहीं दिखती।

AI वीडियो के लिए, previz का एक और काम है: यह ऐसी फ़ाइलें देती है जिन्हें जनरेटर पढ़ सके। पहले फ्रेम की एक साफ़ छवि, आख़िरी फ्रेम की एक साफ़ छवि, कुछ सेकंड का एक वीडियो जिसमें मूवमेंट बिल्कुल साफ़ दिखे, और शॉट का ऐसा विवरण जो उन शब्दों में लिखा हो जिन्हें मॉडल समझते हैं। यह अब चर्चा का साधन नहीं रहा, यह प्रॉम्प्ट का आधा हिस्सा है।

वे चार चीज़ें जो एक previz को आपको देनी चाहिए

प्रारंभिक फ्रेम, अंतिम फ्रेम, संदर्भ वीडियो, संरचित प्रॉम्प्ट: इन चार फ़ाइलों के साथ, जनरेशन एक लॉटरी नहीं बल्कि एक निष्पादन बन जाता है।

प्रारंभिक फ्रेम पहले सेकंड की फ्रेमिंग तय करता है। हर इमेज-टू-वीडियो मॉडल इसे स्वीकार करता है: यह इस बात की गारंटी है कि शॉट ठीक वहीं से शुरू होगा जहाँ आपने तय किया था, सही किरदार सही जगह पर। अंतिम फ्रेम, जिसे Seedance, Kling और Wan स्वीकार करते हैं, आख़िरी सेकंड तय करता है। बीच में, मॉडल को बस एक तार्किक मूवमेंट का प्रक्षेप (इंटरपोलेशन) करना होता है, जो वह अच्छे से करता है।

संदर्भ वीडियो previz का ग्रे रेंडर है, बिल्कुल जैसा है वैसा। कुछ मॉडल इसे मोशन संदर्भ के रूप में लेते हैं: Kling 3.0 Motion Control एक वीडियो के हाव-भाव और प्रक्षेप-पथ को किसी इमेज के किरदार पर दोहराता है। यहाँ, जो कैमरा आपने बनाया वह शाब्दिक रूप से रेंडर का कैमरा बन जाता है। बाक़ी मॉडलों के लिए यह विज़ुअल संदर्भ और जाँच का काम करता है: रेंडर की तुलना previz से, शॉट दर शॉट की जाती है।

अंत में, संरचित प्रॉम्प्ट शॉट को सिनेमा की भाषा में बताता है: अवधि, अनुपात, विषय के सापेक्ष कैमरे की प्रारंभिक स्थिति, ऊँचाई, लेंस और उसकी अनुभूति (वाइड, पोर्ट्रेट), मूवमेंट (इतनी गति से इतने मीटर का ट्रैकिंग शॉट, इतना ऊपर उठना, इतनी डिग्री का पैन), किरदार क्या कर रहे हैं, माहौल और रोशनी। हाथ से लिखा जाए तो यह पैराग्राफ़ बीस मिनट लेता है और उसमें ग़लतियाँ रह जाती हैं। सीन से जनरेट किया जाए तो यह सटीक होता है, क्योंकि यह गणना से निकाला जाता है।

यह सब एक zip फ़ोल्डर में समा जाता है जिसे Imaginode का 3D Previz स्टूडियो एक क्लिक में एक्सपोर्ट करता है, और जो और आगे जाना चाहते हैं उनके लिए कैमरे का मेटाडेटा JSON में भी शामिल होता है। स्टूडियो गाइड हर फ़ाइल का विस्तार से वर्णन करती है।

बिना किसी 3D सॉफ़्टवेयर के, ब्राउज़र में अपनी previz बनाना

एक सीन पाने के लिए एक वाक्य काफ़ी है, बाक़ी काम माउस करता है, और रेंडरिंग मुफ़्त है: previz अब सिर्फ़ उन्हीं लोगों तक सीमित नहीं रही जो Blender में एनिमेट करना जानते हैं।

अब तक, previz बनाने का मतलब था Blender, Unreal या Cinema 4D खोलना, वॉल्यूम मॉडल करना, कैमरा रिग करना और की-फ़्रेम एनिमेट करना सीखना। सिर्फ़ फ्रेमिंग तय करने वाले किसी व्यक्ति के लिए सीखने में हफ़्तों की मेहनत। Imaginode का 3D Previz इस समस्या को उल्टा कर देता है: आप सीन को एक वाक्य में बताते हैं, अगर हों तो संदर्भ इमेज के साथ, और एक AI निर्देशक इसे आपके ब्राउज़र में 3D में बना देता है।

व्यावहारिक रूप से, "रात में एक अस्पताल का गलियारा, एक नर्स दूर स्थित दरवाज़े की ओर चल रहा है, उसके पीछे नीचा कैमरा" से एक गलियारा, दरवाज़े, नाम वाली एक मैनक्विन, ठंडी रोशनी, और किरदार के पीछे फ़र्श से 80 cm ऊँचाई पर रखा गया 35 mm का कैमरा मिलता है। यह कोई जनरेट की गई इमेज नहीं है: यह एक संपादन योग्य सीन है, जहाँ हर तत्व को चुना, हिलाया और समायोजित किया जा सकता है। इसे बनाने में शुरुआत 5 क्रेडिट से होती है, औसतन 12 (एक क्रेडिट एक सेंट के बराबर है), और क्लिक करने से पहले ही कीमत दिखाई जाती है, जैसा Imaginode पर हर जगह होता है।

इसके बाद, आप समायोजन करते हैं। आप कैमरा चुनते हैं, 14 से 135 mm के बीच लेंस चुनते हैं, 25 मूवमेंट में से एक लागू करते हैं (पुश इन, क्रेन, ऑर्बिट, रिवील, वर्टिगो, हैंडहेल्ड) या फ़र्श पर क्लिक-दर-क्लिक करके रास्ता खींचते हैं। आप फ्लाई मोड में हाथ से एक वर्चुअल कैमरा रिकॉर्ड करते हैं, फिर उसे स्मूद करते हैं। आप प्रारंभिक फ्रेम और अंतिम फ्रेम सेट करते हैं। जब क्लिक करने की बजाय बोलना बेहतर लगे, तो आप AI निर्देशक से कह सकते हैं "कैमरे को दो मीटर पीछे ले जाओ और 50 mm पर स्विच करो"।

और आप एक्सपोर्ट करते हैं: इमेज, ब्राउज़र में ही एन्कोड किया गया mp4 वीडियो, कॉन्टैक्ट शीट, हर शॉट का स्टोरीबोर्ड, AI पैकेज। इस सबके लिए कोई क्रेडिट खर्च नहीं होता। स्टूडियो पेज को दर्शाने वाली चिड़िया और गुब्बारे की previz इसी तरह रेंडर की गई थी: एक ही टेक में 27 सेकंड का पीछा, कुछ ही सेकंड में 1080p में एक्सपोर्ट किया गया।

ब्लॉकिंग से रेंडर तक: कैनवस पर का रास्ता

previz उसी प्रोजेक्ट में रहती है जिसमें जनरेशन होती है: एक्सपोर्ट किए गए फ्रेम, आपकी डिस्क से गुज़रे बिना, एक Video नोड के इनपुट बन जाते हैं।

पूरा रास्ता चार चरणों में समाता है। एक, सीन का वर्णन करें और AI निर्देशक को उसे ब्लॉक करने दें। दो, शॉट या शॉट्स को सेट करें: कैमरा, लेंस, मूवमेंट, टाइमलाइन पर किरदारों की स्थिति। तीन, शॉट का AI पैकेज एक्सपोर्ट करें। चार, Imaginode कैनवस पर, प्रारंभिक फ्रेम और अंतिम फ्रेम को एक Video नोड से जोड़ें, संरचित प्रॉम्प्ट पेस्ट करें, मॉडल चुनें और जनरेट करें।

मॉडल के चुनाव के लिए नियम सीधा है। ऐसा शॉट जिसमें कैमरा बहुत हिलता है और किरदार का हाव-भाव सटीक है, वह Kling 3.0 Motion Control की ओर जाता है, संदर्भ वीडियो के साथ। ऐसा शॉट जिसमें हाव-भाव से ज़्यादा फ्रेमिंग मायने रखती है, वह Seedance 2.5 की ओर जाता है, प्रारंभिक और अंतिम फ्रेम के साथ, या 30 सेकंड तक के लंबे शॉट्स के लिए Wan 3.0 की ओर। AI वीडियो जनरेटर के कैमरे को निर्देशित करने पर हमारी गाइड मॉडल दर मॉडल व्यवहारों की तुलना करती है।

एक बात जो सब कुछ बदल देती है: previz को दोबारा नहीं बनाना पड़ता। अगर पहला रेंडर सही नहीं है, तो आप मॉडल बदलते हैं या प्रॉम्प्ट समायोजित करते हैं, लेकिन सीन, कैमरा और फ्रेम वही रहते हैं। आप हर प्रयास में शून्य से शुरू नहीं करते, और यहीं क्रेडिट बचते हैं।

"दस प्रॉम्प्ट" वाली विधि की तुलना में इसकी क़ीमत क्या है

एक previz की क़ीमत एक बार में लगभग एक दर्जन क्रेडिट है; टाली गई हर वीडियो जनरेशन बीस से साठ क्रेडिट बचाती है।

1080p में 10 सेकंड का एक शॉट लें। कैनवस पर, एक Seedance 2.5 जनरेशन लगभग 60 क्रेडिट की होती है, Kling V3 इससे थोड़ा कम, Wan 3.0 रिज़ॉल्यूशन के अनुसार इससे ज़्यादा; कैलकुलेटर उस दिन के सटीक मान देता है। इच्छित फ्रेमिंग तक पहुँचने के लिए दस प्रयासों में 400 से 600 क्रेडिट लगते हैं, यानी सिर्फ़ एक शॉट के लिए 4 से 6 यूरो।

previz के साथ, सीन की क़ीमत लगभग एक दर्जन क्रेडिट होती है, हर संदेश पर समायोजन दो या तीन क्रेडिट के, और रेंडरिंग व एक्सपोर्ट मुफ़्त। फिर आप दस बार की बजाय एक या दो बार जनरेट करते हैं। बीस शॉट्स वाली फ़िल्म पर, यह अंतर दसियों यूरो और बचे हुए घंटों के इंतज़ार में गिना जाता है। और सबसे ज़्यादा मायने रखने वाली दलील क़ीमत नहीं है: वह यह है कि अंतिम फ्रेमिंग वही है जो आपने तय की थी।

Higgsfield ने 4 सितंबर 2026 को सब्सक्रिप्शन आधारित एक प्रॉम्प्ट-चालित 3D सीन टूल, 3D Jutsu, लॉन्च किया। हमने इसे इस लेख में बारीक़ी से देखा: दोनों तरीक़े सिद्धांत में एक जैसे लगते हैं, लेकिन क़ीमत, जनरेटर के साथ एकीकरण और कैमरा नियंत्रण में अलग हैं।

previz की पाँच ग़लतियाँ जो बाद में भारी पड़ती हैं

एक उपयोगी previz सादी होती है, सही स्केल में होती है, और उस मॉडल को ध्यान में रखकर बनाई जाती है जो उसे पढ़ेगा।

पहली ग़लती: previz को सुंदर बनाना चाहना। इसे पठनीय होना चाहिए। ग्रे वॉल्यूम और एक मैनक्विन काफ़ी है; बहुत ज़्यादा विवरणों से भरी सीन संदर्भ वीडियो पर कैमरा मूवमेंट को कम साफ़ दिखाती है, और मॉडल ऐसे विवरणों से चिपक जाता है जिनका कोई मतलब नहीं होता।

दूसरी: स्केल भूल जाना। एक मैनक्विन 1.75 मीटर की होती है, एक दरवाज़ा 2.10 मीटर का, एक कार 4.5 मीटर की। अगर अनुपात ग़लत हों, तो लेंस झूठ बोलता है, और रेंडर एक मॉडल जैसा दिखने लगता है। Imaginode की ब्लॉकिंग किट हर ऑब्जेक्ट को उसके असली आकार में रखती है, और स्मार्ट प्लेसमेंट उसे फ़र्श पर टिका देता है।

तीसरी: एक ऐसा कैमरा जो सब कुछ एक साथ करता है। एक ही 8 सेकंड के शॉट में ट्रैकिंग शॉट, ऊपर उठना, पैन और ज़ूम, कोई भी मॉडल इसे सही से नहीं निभा पाता। एक शॉट में एक मुख्य मूवमेंट, ज़्यादा से ज़्यादा दो। स्टूडियो के 25 प्रीसेट इसीलिए हैं।

चौथी: अंतिम फ्रेम की उपेक्षा करना। यही वह चीज़ है जो मॉडल को शॉट के दूसरे आधे हिस्से में भटकने से रोकती है, और यह वह पहली चीज़ है जिसे एक्सपोर्ट करना लोग भूल जाते हैं। पाँचवीं: किरदारों के नाम न रखना। सीन में "लीया" नाम की एक मैनक्विन संरचित प्रॉम्प्ट में भी "लीया" बन जाती है, और आप कैनवस पर इसके साथ अपने संदर्भ किरदार को जोड़ सकते हैं।

कहाँ से शुरू करें

एक शॉट, एक वाक्य, एक एक्सपोर्ट: दस मिनट में, आप जान जाएँगे कि यह तरीक़ा आपके लिए सही है या नहीं।

एक ऐसा शॉट चुनें जिसे आप प्रॉम्प्ट के ज़रिए कभी सही तरीक़े से नहीं पा सके। 3D Previz खोलें, इसे एक वाक्य में बताएँ, सीन को बनने दें। कैमरे को माउस से तब तक समायोजित करें जब तक इनसेट वैसा फ्रेम न दिखा दे जो आपके दिमाग़ में था, प्रारंभिक फ्रेम और अंतिम फ्रेम सेट करें, पैकेज एक्सपोर्ट करें।

फिर सही मॉडल के साथ कैनवस पर सिर्फ़ एक बार जनरेट करें। ग्रे रेंडर से तुलना करें। अगर शॉट सही निकले, तो आपने अभी नौ जनरेशन बचाई हैं। अगर नहीं, तो आपको ठीक-ठीक पता चल जाएगा कि क्या भटका, क्योंकि आपके पास तुलना के लिए एक संदर्भ मौजूद है। यही है previz: जो आप चाहते थे उसकी याद रखने के बजाय, उसके ख़िलाफ़ जाँचने के लिए एक संदर्भ।

असली कैनवास पर आज़माना चाहेंगे?

इस आर्टिकल में बताई हर चीज़ Imaginode पर होती है, सीधे आपके ब्राउज़र में।

शुरू करें