डॉक्युमेंटेशन

कैनवास और नोड

टेक्स्ट, इमेज, वीडियो, मीडिया, रेफ़रेंस, स्टाइल: अपने वर्कफ़्लो बनाने के लिए नोड कैसे जोड़ें।

नोड के प्रकार

Text नोड में कोई आइडिया या प्रॉम्प्ट रहता है, और वह किसी लैंग्वेज मॉडल (GPT-5, Claude, Gemini...) से आपके लिए प्रॉम्प्ट लिख भी सकता है। Image और Video नोड AI से कंटेंट बनाते हैं। Media नोड आपकी अपनी फ़ाइलें लाता है। Camera नोड तय करता है कि सीन को किस नज़र से देखा जाए। Reference नोड किसी बार-बार आने वाले किरदार या चीज़ को याद रखता है। और Style नोड पूरी आर्ट डायरेक्शन तय कर देता है।

हर नोड को कहीं भी खिसकाया जा सकता है; क्रॉस से या Delete दबाकर हटाइए। Ctrl+Z / Ctrl+Y से अनडू और रीडू कीजिए।

नोड आपस में जोड़ना

एक नोड के दाईं ओर के हैंडल से खींचकर दूसरे नोड के बाएँ हैंडल तक लिंक बनाइए। किसी Image नोड के “prompt” पोर्ट से जुड़ा Text नोड अपना टेक्स्ट प्रॉम्प्ट में जोड़ देता है: नोड के अंदर एक नीला बॉक्स बता देता है कि किन-किन बातों को गिना गया। Video से जुड़ी Image उसका पहला फ़्रेम बन जाती है। और इमेज वाला Media नोड विज़ुअल रेफ़रेंस का काम करता है।

कुछ वीडियो मॉडल एंड इमेज भी लेते हैं: जिन मॉडलों में यह मुमकिन है, उनमें “एंड इमेज” पोर्ट अपने आप दिख जाता है।

@ रेफ़रेंस और स्टाइल

एक Reference नोड बनाइए, उसे नाम, विवरण और कुछ फ़ोटो दीजिए: यही आपका किरदार है। इसके बाद किसी भी प्रॉम्प्ट में @ टाइप कीजिए, आपके रेफ़रेंस की सूची खुल जाएगी और चुना हुआ नाम नियॉन हरे रंग में दिखेगा। जेनरेट करते समय विवरण प्रॉम्प्ट में जुड़ जाता है और इमेज भी साथ भेजी जाती हैं (एडिटिंग वाले मॉडल जैसे Seedream 5 Lite या GPT Image Mini के साथ)।

Style नोड भी इसी तरह काम करता है, बस उसे जोड़ना पड़ता है: उसे अपने Image और Video नोड से जोड़ दीजिए, तो हर जगह एक ही आर्ट डायरेक्शन बनी रहेगी।

सब मिलाकर

पूरे वर्कफ़्लो का एक उदाहरण: Text से Image (Flux 2 Klein), फिर Video (Kling), और दोनों से जुड़ा एक Camera नोड ताकि रिज़ल्ट एक जैसा रहे, साथ में एक साझा Style। हर Image और Video नोड अपनी जेनरेशन का इतिहास रखता है: किसी थंबनेल पर क्लिक करके उस पर लौट आइए। और सब कुछ अपने आप सेव होता रहता है।

रीटच नोड

रीटच नोड कैनवास पर लेयर की एक छोटी कार्यशाला है। इमेज या मीडिया नोड को इसके लेयर पोर्ट से जोड़ें: हर छवि एक लेयर बन जाती है जिसे आप हिलाते, आकार बदलते, घुमाते, हल्का करते और दूसरी लेयर के साथ मिलाते हैं। इरेज़र किसी हिस्से को पारदर्शी बनाता है (किसी विषय को काटने या नीचे की लेयर पर खिड़की खोलने के लिए), वापस लाएँ ब्रश उसे लौटाता है। ऊपर टेक्स्ट जोड़ें, दस्तावेज़ का आकार और पृष्ठभूमि चुनें, फिर एक्सपोर्ट करें: PNG पारदर्शिता बनाए रखती है, सब कुछ आपके ब्राउज़र में गिना जाता है, बिना क्रेडिट के।

हर इमेज लेयर पर दो AI क्रियाएँ हैं: किसी हिस्से को रीटच करना (आप हाइलाइट करें, बताएँ, Nano Banana बदल देता है) और बड़ा करना (Topaz, ×2 या ×4), दूसरे नोड जैसे ही दाम पर। एक क्लिक से पिछली छवि लौट आती है। नोड का आउटपुट वहीं जुड़ता है जहाँ कोई भी छवि जुड़ती है: वीडियो का पहला फ़्रेम, संदर्भ, मोंटाज।

वीडियो टूल्स: मोशन, विस्तार, लिप्स, बैकग्राउंड

Video node केवल जनरेट ही नहीं करता: आपके चुने गए मॉडल के अनुसार, यह किसी मौजूदा वीडियो को भी बदल देता है। Kling 3.0 Motion Control किसी वीडियो की हरकत ("मोशन वीडियो" पोर्ट) को लेता है और उसे किसी इमेज के किरदार (इमेज पोर्ट) से दोहराता है: कोई डांस, कोई चाल, कोई कोरियोग्राफी, किसी भी चेहरे पर। Grok Imagine (विस्तार) किसी वीडियो के आखिरी फ़्रेम से उसका आगे का हिस्सा, उसी फ़ॉर्मैट में जनरेट करता है: आप जोड़े जाने वाले सेकंड तय करते हैं और बताते हैं कि आगे क्या होता है। यह आगे वाला हिस्सा अलग से निकलता है, जिसे Montage node में जोड़ा जा सकता है।

Sync Lipsync 3 किसी वीडियो के लिप्स को किसी वायर्ड वॉइस (वॉइस पोर्ट) के साथ फिर से मिलाता है: वही शॉट, बस एक अलग भाषा या स्क्रिप्ट में। InfiniTalk यही काम किसी फ़ोटो से करता है: चेहरा वॉइस की पूरी अवधि तक बोलता है, भाव-भंगिमाओं के साथ। Bria video background किसी वीडियो से बैकग्राउंड हटाता है और सब्जेक्ट व उसकी आवाज़ को बनाए रखता है: आपके एडिट के लिए पारदर्शी webm, या हरे, काले या सफ़ेद बैकग्राउंड पर mp4।

इन पाँच टूल्स की क़ीमत सर्वर पर मापे गए सोर्स पर तय होती है, कभी भी बताई गई अवधि पर नहीं: node वायर्ड वीडियो या वॉइस की लंबाई पढ़ता है और क्लिक करने से पहले सटीक क़ीमत दिखाता है। कोई मॉडल केवल वही सेटिंग्स दिखाता है जिन्हें वह सच में मानता है: जब कोई सेलेक्टर गायब हो, तो इसका मतलब है कि मॉडल उसे ध्यान में नहीं रखता।

किसी Text node में PDF पढ़ना

किसी PDF को कैनवस पर छोड़ें: एक Media node उसे प्राप्त करता है, जैसे किसी इमेज या वीडियो को। इसे किसी Text node के "विश्लेषण के लिए इमेज या PDF" पोर्ट से जोड़ें, जो किसी दस्तावेज़ पढ़ने वाले मॉडल (GPT, Claude, Gemini, Kimi K3, Grok 4.6, DeepSeek V4 और इस तरह चिह्नित अन्य) पर सेट हो: मॉडल पूरा दस्तावेज़ प्राप्त करता है और आपके निर्देश का जवाब देता है, सारांश, निष्कर्षण, फिर से लिखना, कंटेंट प्लान, इलस्ट्रेशन प्रॉम्प्ट्स।

क़ीमत दस्तावेज़ के आकार के अनुसार तय होती है: node फ़ाइल सबमिट होते ही लागत आरक्षित कर लेता है, फिर वास्तव में पढ़े गए टोकन्स की संख्या के अनुसार समायोजित करता है, और बाक़ी राशि आपके बैलेंस में वापस आ जाती है। हर node में तीन दस्तावेज़ तक। जवाब सीधे पीछे जोड़े गए Image और Video nodes को फ़ीड करता है: कोई रिपोर्ट कैरूसल बन जाती है, कोई मैनुअल वीडियो ट्यूटोरियल बन जाता है।

मेरे किरदार

एक अच्छी तरह भरा हुआ Reference node (नाम, विवरण, फ़ोटो) रखने लायक होता है। "मेरे किरदारों में सेव करें" बटन उसे आपके अकाउंट में सुरक्षित रखता है। किसी भी दूसरे प्रोजेक्ट में, "मेरे किरदार" लिस्ट खोलता है और एक क्लिक में किसी Reference node को भर देता है, नाम, विवरण और इमेजेस़ सहित। हर अकाउंट में तीस किरदार तक, हर एक के आठ इमेजेस़।

किसी किरदार में बदलाव उस node से होता है जिससे उसे लोड किया गया था, और उसे लिस्ट से डिलीट किया जा सकता है। यही वह चीज़ है जो एक ही मैस्कट, एक ही प्रेज़ेंटर या एक ही प्रोडक्ट को हफ़्ते-दर-हफ़्ते बनाए रखने देती है, बिना कार्ड को फिर से बनाए।

3D Object node

3D Object node किसी इमेज को 3D फ़ाइल में बदल देता है। कोई इमेज जोड़ें (अपलोड की गई फ़ोटो या किसी Image node का रेंडर): Tripo 2.5 या Trellis 2 उससे एक टेक्स्चर्ड GLB बनाते हैं, वह फ़ॉर्मैट जिसे Blender, Unity, Unreal और वेब व्यूअर्स पढ़ते हैं। मॉडल node में दिखता है, उंगली या माउस से घूमता है, और डाउनलोड किया जा सकता है।

इसके बाद आपके ब्राउज़र में बिना किसी क़ीमत के दो रेंडर बनते हैं: पाँच सेकंड का टर्नटेबल (वीडियो पोर्ट) और एक स्थिर व्यू (इमेज पोर्ट)। टर्नटेबल किसी Video node, Wan 3.0 या Seedance 2.5 में रेफ़रेंस के रूप में जोड़ा जाता है, जो ऑब्जेक्ट को दिखाते हुए उसका आकार बनाए रखता है। व्यू वहाँ जोड़ा जा सकता है जहाँ भी कोई इमेज इनपुट होती है। एक साधारण बैकग्राउंड पर पूरा ऑब्जेक्ट सबसे बेहतर वॉल्यूम देता है; कोई सीन या फ़्रेम से कटा हुआ सब्जेक्ट कम बेहतर परिणाम देता है।

इस गाइड को अमल में लाने के लिए तैयार हैं?

अकाउंट बनाएँ और कैनवास एक्सप्लोर करें: आप उतना ही चुकाते हैं जितना जनरेट करते हैं।

शुरू करें