सभी टूल

AI से दो आवाज़ों का पॉडकास्ट बनाएँ

दो होस्ट के बीच आठ संवादों की बातचीत, ElevenLabs Dialogue v3 एक ही टेक में निभाता है: दो आवाज़ें, आपसी लय, हँसी। पूरा वर्कफ़्लो बिना खाते के दिखता है, एपिसोड के साथ।

इंटरैक्टिव डेमो

असली वर्कफ़्लो, असली नतीजे। खुलकर घुमाइए और ज़ूम कीजिए।

यह वर्कफ़्लो इस्तेमाल करें

असली वर्कफ़्लो: संवाद मोड में एक ही वॉयस-ओवर नोड, आठ संवाद, हर संवाद की अपनी आवाज़, ElevenLabs Dialogue v3 पर। एपिसोड सुनिए।

एक नज़र में

यह वर्कफ़्लो क्या बनाता है
1 वॉइस ओवर
कैनवास की बनावट
0 कनेक्शन से जुड़े 2 नोड
जुड़े हुए मॉडल
ElevenLabs Dialogue v3
एक पूरे राउंड का ख़र्च
लगभग 7 क्रेडिट, यानी $0.08

दो आवाज़ों का पॉडकास्ट दो वॉयस-ओवर एक के बाद एक चिपकाकर नहीं बनता: संवादों के बीच की चुप्पी झूठी लगती है, जोड़ बहुत साफ़ होते हैं, कोई सही वक़्त पर नहीं हँसता। ElevenLabs Dialogue v3 सारे संवाद एक साथ पाता है और पूरी बातचीत एक टेक में निभाता है, जैसे एक ही कमरे में बैठे दो लोग। डेमो एक मिनट का है, एक सीधे सवाल पर: उम्र बढ़ने के साथ वक़्त तेज़ क्यों बीतता है।

सब कुछ संवाद मोड वाले एक वॉयस-ओवर नोड में समा जाता है। हर संवाद की अपनी आवाज़ है, मॉडल की इक्कीस आवाज़ों में से चुनी हुई; डेमो एक महिला और एक पुरुष आवाज़ लेता है, क्योंकि दो मिलती-जुलती आवाज़ें एकालाप जैसी लगती हैं। बड़े कोष्ठकों वाले टैग, [laughs], [curious], [whispers], अभिनय को दिशा देते हैं और पढ़े नहीं जाते: डेमो का पाँचवाँ संवाद [laughs] से शुरू होता है, और वह सुनाई देता है।

एक नोड में अधिकतम दस संवाद, तीन हज़ार अक्षर। लंबे एपिसोड के लिए कई नोड जोड़ें और मॉन्टाज नोड में मिलाएँ। मॉडल अक्षर के हिसाब से पैसे लेता है: बोलने के हर मिनट पर दर्जन भर क्रेडिट मान लें। एक घंटे का पॉडकास्ट बारह डॉलर से कम में।

कैसे करें

  1. 1

    बातचीत संवाद दर संवाद लिखें

    छोटे वाक्य, जैसे लोग बोलते हैं। एक विचार पर एक संवाद। उन्हें जवाब देने दें, टोकने दें, काटने दें: पॉडकास्ट आवाजाही से बनता है, लंबे भाषणों से नहीं।

  2. 2

    हर संवाद को एक आवाज़ दें

    एक महिला, एक पुरुष, अलग-अलग रंग की। एक ही होस्ट के लिए शुरू से आख़िर तक वही आवाज़। नोड सूची दिखाता है, चुनने से पहले दो सुन लें।

  3. 3

    अभिनय के टैग लगाएँ

    मज़ाकिया संवाद से पहले [laughs], सवाल से पहले [curious], रियायत से पहले [sighs]। एक संवाद पर ज़्यादा से ज़्यादा एक टैग, बाक़ी मॉडल कर लेता है।

  4. 4

    जनरेट करें, सुनें, एक संवाद सुधारें

    नोड पूरी बातचीत निभाता है। कोई संवाद ग़लत लगे तो उसका पाठ या टैग बदलकर दोबारा चलाएँ: मॉडल सब कुछ फिर से निभाता है, शुरू से आख़िर तक एकसार।

वेरिएंट और इस्तेमाल के तरीके

वही कैनवास, अलग-अलग ज़रूरतों के लिए सेट किया हुआ: हर वेरिएंट में प्रॉम्प्ट की बस दो-तीन लाइनें बदलनी होती हैं।

बिना स्टूडियो का कंपनी पॉडकास्ट

हर एपिसोड की एक स्क्रिप्ट, दो तय आवाज़ें, हर नोड एक मिनट। एडिट नोड जोड़ता है, जिंगल और संगीत लगाता है। न माइक, न कमरा, न ख़राब टेक।

लेख का बातचीत में सार

एक आवाज़ से सवाल पुछवाएँ और दूसरी से जवाब: ब्लॉग का लेख पाँच मिनट की ऐसी बातचीत बन जाता है जो चलते-चलते सुनी जाए। कैनवस का टेक्स्ट मॉडल स्क्रिप्ट लिख सकता है।

प्रशिक्षण या पढ़ाई का संवाद

शिक्षक और छात्र, ग्राहक और सलाहकार, मरीज़ और डॉक्टर। दो आवाज़ें और झिझक के टैग, और मामला जीवंत हो जाता है। हर परिदृश्य अपने नोड में।

ऑडियो कहानी का एक दृश्य

दो पात्र, भाव के टैग, [whispers], [sad], [excited], और दृश्य के नीचे बनाया गया साउंड इफ़ेक्ट। मॉन्टाज नोड आवाज़ों को माहौल के ऊपर रखता है।

दो आवाज़ों का ऑडियो विज्ञापन

तीस सेकंड, एक सवाल और एक जवाब, आख़िरी संवाद में ब्रांड। महिला और पुरुष आवाज़ भूमिकाएँ बाँट लेती हैं, एडिट संगीत जोड़ देता है।

एपिसोड, फिर सफ़ाई और प्रकाशन

फ़ाइल साफ़ ही निकलती है; कोई स्तर बराबर करना हो तो एन्हांस नोड सँभाल लेता है। MP3 नोड से डाउनलोड होती है, पॉडकास्ट प्लेटफ़ॉर्म के लिए तैयार।

आम ग़लतियाँ

दो मिलती-जुलती आवाज़ें

एक ही उम्र की दो महिला आवाज़ें, या दो गहरी पुरुष आवाज़ें: पता ही नहीं चलता कौन बोल रहा है। डेमो की तरह हर रंग की एक आवाज़ लें और एपिसोड दर एपिसोड वही रखें।

संवाद की जगह भाषण

दो सौ शब्दों का संवाद बातचीत नहीं, व्याख्यान है। उसे काटें, दूसरी आवाज़ से आगे बढ़वाएँ। पॉडकास्ट की लय आवाजाही से आती है।

बहुत ज़्यादा टैग

एक संवाद पर एक टैग अभिनय को दिशा देता है; चार उसका मज़ाक बना देते हैं। हर पंक्ति पर [laughs] आख़िर में झूठा लगने लगता है। डेमो आठ संवादों में दो इस्तेमाल करता है।

दस संवादों से आगे जाना

नोड दस संवाद और तीन हज़ार अक्षर लेता है, ताकि मॉडल बातचीत की एकसारता बनाए रखे। इससे आगे कई नोड में बाँटें और एडिट में मिलाएँ।

सुझाए गए मॉडल

अक्सर पूछे जाने वाले सवाल

क्या दोनों आवाज़ें सचमुच एक-दूसरे को जवाब देती हैं?

हाँ। मॉडल संवादों को एक साथ पाता है और आपसी जोड़, साँसें और बातचीत की लय सँभालता है। एडिट में जोड़े गए दो वॉयस-ओवर से यही फ़र्क़ है।

क्या मैं अपनी आवाज़ इस्तेमाल कर सकता हूँ?

यहाँ नहीं। मॉडल के पास इक्कीस आवाज़ें हैं, वह क्लोन नहीं करता। अपनी जैसी आवाज़ में पाठ पढ़वाने के लिए अपनी आवाज़ बदलें वर्कफ़्लो आपकी रिकॉर्डिंग को दूसरे रंग में दोबारा निभाता है।

किस भाषा में?

आपके संवादों की भाषा में, साइट की चौदह भाषाओं में। भाषा नोड पर तय होती है; डेमो हिंदी में है, उन आवाज़ों के साथ जो इसे बोलना जानती हैं।

एक एपिसोड की क़ीमत क्या है?

क़ीमत अक्षर के हिसाब से बनती है और क्लिक से पहले नोड पर दिखती है, बोलने के हर मिनट पर दर्जन भर क्रेडिट। डेमो की बातचीत, एक हज़ार अक्षर, चौदह क्रेडिट की पड़ती है। एक घंटे का पॉडकास्ट बारह डॉलर से कम में।

कितनी अलग-अलग आवाज़ें हैं?

इक्कीस, महिला और पुरुष, सब साइट की चौदह भाषाएँ बोल सकती हैं। एक संवाद में दो से ज़्यादा भी मिल सकती हैं, पर पॉडकास्ट के लिए दो काफ़ी हैं।

एक नोड की अधिकतम लंबाई क्या है?

तीन हज़ार अक्षर, क़रीब तीन मिनट की बातचीत। बीस मिनट का एपिसोड यानी मॉन्टाज नोड में जुड़े सात नोड, हर एक अलग से दोबारा चलाया जा सकता है।

क्या मैं संगीत और जिंगल जोड़ सकता हूँ?

हाँ, उसी कैनवस में: थीम के लिए एक म्यूज़िक नोड, और आवाज़ों को उस पर रखने के लिए मॉन्टाज नोड। वीडियो में आवाज़ जोड़ें वर्कफ़्लो यही सिद्धांत दिखाता है।

क्या यह फ़ोन से हो सकता है?

हाँ। कैनवस मोबाइल पर चलता है, संवाद नोड में लिखे जाते हैं और एपिसोड उसी में सुना जाता है। मोबाइल पर बनाएँ गाइड में इशारे समझाए गए हैं।

AI से दो आवाज़ों का पॉडकास्ट बनाएँ

यह वर्कफ़्लो इस्तेमाल करें

मुफ़्त अकाउंट, बिना क्रेडिट कार्ड। वर्कफ़्लो आपके कैनवास में पहले से भरा हुआ खुलता है।