बिना स्टूडियो का कंपनी पॉडकास्ट
हर एपिसोड की एक स्क्रिप्ट, दो तय आवाज़ें, हर नोड एक मिनट। एडिट नोड जोड़ता है, जिंगल और संगीत लगाता है। न माइक, न कमरा, न ख़राब टेक।
दो होस्ट के बीच आठ संवादों की बातचीत, ElevenLabs Dialogue v3 एक ही टेक में निभाता है: दो आवाज़ें, आपसी लय, हँसी। पूरा वर्कफ़्लो बिना खाते के दिखता है, एपिसोड के साथ।
असली वर्कफ़्लो, असली नतीजे। खुलकर घुमाइए और ज़ूम कीजिए।
यह वर्कफ़्लो इस्तेमाल करेंअसली वर्कफ़्लो: संवाद मोड में एक ही वॉयस-ओवर नोड, आठ संवाद, हर संवाद की अपनी आवाज़, ElevenLabs Dialogue v3 पर। एपिसोड सुनिए।
एक नज़र में
दो आवाज़ों का पॉडकास्ट दो वॉयस-ओवर एक के बाद एक चिपकाकर नहीं बनता: संवादों के बीच की चुप्पी झूठी लगती है, जोड़ बहुत साफ़ होते हैं, कोई सही वक़्त पर नहीं हँसता। ElevenLabs Dialogue v3 सारे संवाद एक साथ पाता है और पूरी बातचीत एक टेक में निभाता है, जैसे एक ही कमरे में बैठे दो लोग। डेमो एक मिनट का है, एक सीधे सवाल पर: उम्र बढ़ने के साथ वक़्त तेज़ क्यों बीतता है।
सब कुछ संवाद मोड वाले एक वॉयस-ओवर नोड में समा जाता है। हर संवाद की अपनी आवाज़ है, मॉडल की इक्कीस आवाज़ों में से चुनी हुई; डेमो एक महिला और एक पुरुष आवाज़ लेता है, क्योंकि दो मिलती-जुलती आवाज़ें एकालाप जैसी लगती हैं। बड़े कोष्ठकों वाले टैग, [laughs], [curious], [whispers], अभिनय को दिशा देते हैं और पढ़े नहीं जाते: डेमो का पाँचवाँ संवाद [laughs] से शुरू होता है, और वह सुनाई देता है।
एक नोड में अधिकतम दस संवाद, तीन हज़ार अक्षर। लंबे एपिसोड के लिए कई नोड जोड़ें और मॉन्टाज नोड में मिलाएँ। मॉडल अक्षर के हिसाब से पैसे लेता है: बोलने के हर मिनट पर दर्जन भर क्रेडिट मान लें। एक घंटे का पॉडकास्ट बारह डॉलर से कम में।
बातचीत संवाद दर संवाद लिखें
छोटे वाक्य, जैसे लोग बोलते हैं। एक विचार पर एक संवाद। उन्हें जवाब देने दें, टोकने दें, काटने दें: पॉडकास्ट आवाजाही से बनता है, लंबे भाषणों से नहीं।
हर संवाद को एक आवाज़ दें
एक महिला, एक पुरुष, अलग-अलग रंग की। एक ही होस्ट के लिए शुरू से आख़िर तक वही आवाज़। नोड सूची दिखाता है, चुनने से पहले दो सुन लें।
अभिनय के टैग लगाएँ
मज़ाकिया संवाद से पहले [laughs], सवाल से पहले [curious], रियायत से पहले [sighs]। एक संवाद पर ज़्यादा से ज़्यादा एक टैग, बाक़ी मॉडल कर लेता है।
जनरेट करें, सुनें, एक संवाद सुधारें
नोड पूरी बातचीत निभाता है। कोई संवाद ग़लत लगे तो उसका पाठ या टैग बदलकर दोबारा चलाएँ: मॉडल सब कुछ फिर से निभाता है, शुरू से आख़िर तक एकसार।
वही कैनवास, अलग-अलग ज़रूरतों के लिए सेट किया हुआ: हर वेरिएंट में प्रॉम्प्ट की बस दो-तीन लाइनें बदलनी होती हैं।
हर एपिसोड की एक स्क्रिप्ट, दो तय आवाज़ें, हर नोड एक मिनट। एडिट नोड जोड़ता है, जिंगल और संगीत लगाता है। न माइक, न कमरा, न ख़राब टेक।
एक आवाज़ से सवाल पुछवाएँ और दूसरी से जवाब: ब्लॉग का लेख पाँच मिनट की ऐसी बातचीत बन जाता है जो चलते-चलते सुनी जाए। कैनवस का टेक्स्ट मॉडल स्क्रिप्ट लिख सकता है।
शिक्षक और छात्र, ग्राहक और सलाहकार, मरीज़ और डॉक्टर। दो आवाज़ें और झिझक के टैग, और मामला जीवंत हो जाता है। हर परिदृश्य अपने नोड में।
दो पात्र, भाव के टैग, [whispers], [sad], [excited], और दृश्य के नीचे बनाया गया साउंड इफ़ेक्ट। मॉन्टाज नोड आवाज़ों को माहौल के ऊपर रखता है।
तीस सेकंड, एक सवाल और एक जवाब, आख़िरी संवाद में ब्रांड। महिला और पुरुष आवाज़ भूमिकाएँ बाँट लेती हैं, एडिट संगीत जोड़ देता है।
फ़ाइल साफ़ ही निकलती है; कोई स्तर बराबर करना हो तो एन्हांस नोड सँभाल लेता है। MP3 नोड से डाउनलोड होती है, पॉडकास्ट प्लेटफ़ॉर्म के लिए तैयार।
एक ही उम्र की दो महिला आवाज़ें, या दो गहरी पुरुष आवाज़ें: पता ही नहीं चलता कौन बोल रहा है। डेमो की तरह हर रंग की एक आवाज़ लें और एपिसोड दर एपिसोड वही रखें।
दो सौ शब्दों का संवाद बातचीत नहीं, व्याख्यान है। उसे काटें, दूसरी आवाज़ से आगे बढ़वाएँ। पॉडकास्ट की लय आवाजाही से आती है।
एक संवाद पर एक टैग अभिनय को दिशा देता है; चार उसका मज़ाक बना देते हैं। हर पंक्ति पर [laughs] आख़िर में झूठा लगने लगता है। डेमो आठ संवादों में दो इस्तेमाल करता है।
नोड दस संवाद और तीन हज़ार अक्षर लेता है, ताकि मॉडल बातचीत की एकसारता बनाए रखे। इससे आगे कई नोड में बाँटें और एडिट में मिलाएँ।
हाँ। मॉडल संवादों को एक साथ पाता है और आपसी जोड़, साँसें और बातचीत की लय सँभालता है। एडिट में जोड़े गए दो वॉयस-ओवर से यही फ़र्क़ है।
यहाँ नहीं। मॉडल के पास इक्कीस आवाज़ें हैं, वह क्लोन नहीं करता। अपनी जैसी आवाज़ में पाठ पढ़वाने के लिए अपनी आवाज़ बदलें वर्कफ़्लो आपकी रिकॉर्डिंग को दूसरे रंग में दोबारा निभाता है।
आपके संवादों की भाषा में, साइट की चौदह भाषाओं में। भाषा नोड पर तय होती है; डेमो हिंदी में है, उन आवाज़ों के साथ जो इसे बोलना जानती हैं।
क़ीमत अक्षर के हिसाब से बनती है और क्लिक से पहले नोड पर दिखती है, बोलने के हर मिनट पर दर्जन भर क्रेडिट। डेमो की बातचीत, एक हज़ार अक्षर, चौदह क्रेडिट की पड़ती है। एक घंटे का पॉडकास्ट बारह डॉलर से कम में।
इक्कीस, महिला और पुरुष, सब साइट की चौदह भाषाएँ बोल सकती हैं। एक संवाद में दो से ज़्यादा भी मिल सकती हैं, पर पॉडकास्ट के लिए दो काफ़ी हैं।
तीन हज़ार अक्षर, क़रीब तीन मिनट की बातचीत। बीस मिनट का एपिसोड यानी मॉन्टाज नोड में जुड़े सात नोड, हर एक अलग से दोबारा चलाया जा सकता है।
हाँ, उसी कैनवस में: थीम के लिए एक म्यूज़िक नोड, और आवाज़ों को उस पर रखने के लिए मॉन्टाज नोड। वीडियो में आवाज़ जोड़ें वर्कफ़्लो यही सिद्धांत दिखाता है।
हाँ। कैनवस मोबाइल पर चलता है, संवाद नोड में लिखे जाते हैं और एपिसोड उसी में सुना जाता है। मोबाइल पर बनाएँ गाइड में इशारे समझाए गए हैं।
AI से दो आवाज़ों का पॉडकास्ट बनाएँ
यह वर्कफ़्लो इस्तेमाल करेंमुफ़्त अकाउंट, बिना क्रेडिट कार्ड। वर्कफ़्लो आपके कैनवास में पहले से भरा हुआ खुलता है।