अकेले कई किरदार डब करना
तीन आवाज़ों की कहानी, एक संवाद, एक फ़िक्शन पॉडकास्ट: सारे संवाद आप निभाते हैं, हर किरदार की एक लक्ष्य आवाज़, हर किरदार का एक नोड। अभिनय हर जगह आपका है, सिर्फ़ टिंबर भूमिकाओं को अलग करता है।
एक पुरुष आवाज़ में कहा गया वाक्य, ElevenLabs Voice Changer से तीन आवाज़ों में दोबारा, एक महिला, एक युवा पुरुष, एक बड़ी उम्र का पुरुष, मूल लय और स्वर के साथ। पूरा वर्कफ़्लो, बिना खाता बनाए।
असली वर्कफ़्लो, असली नतीजे। खुलकर घुमाइए और ज़ूम कीजिए।
यह वर्कफ़्लो इस्तेमाल करेंअसली वर्कफ़्लो: वही वाक्य तीन «आवाज़ सुधारें» नोड में जाता है, हर एक पर एक लक्ष्य आवाज़ सेट, और आप सुनते हैं क्या बदलता है और क्या रहता है।
एक नज़र में
जब सिर्फ़ एक आवाज़ हो और डब करने को एक किरदार, कोई वॉइस ओवर जिसे आप भारी या जवान चाहते हैं, कोई वॉइस मैसेज जिसे गुमनाम करना हो: वॉइस चेंजर एक साधारण रिकॉर्डिंग से यह सब करता है। यह वर्कफ़्लो उसे ElevenLabs Voice Changer से तीन लक्ष्य आवाज़ों के साथ अगल-बगल गुज़ारता है, ताकि एक साथ सुन सकें कि क्या बदलता है और क्या बचता है।
जो बचता है वही असल है: लय, ठहराव, हिचक, स्वर। चेंजर वाक्य को दोबारा नहीं लिखता, उसे दूसरे टिंबर में दोहराता है। डेमो के वाक्य में एक सवाल, एक ठहराव और एक अंत है, और तीनों आवाज़ें उन्हें हूबहू दोहराती हैं। यह स्पीच सिंथेसिस नहीं है: यह आपका अभिनय है, दूसरे गले में।
ElevenLabs की इक्कीस आवाज़ें चुनने को, और कोई निजी आवाज़ नहीं: यह टूल भेस बदलता है, क्लोन नहीं करता। आपकी फ़ाइल नोड के इंपोर्ट बटन से आती है, एक बार में दस मिनट तक, सेकंड के हिसाब से: बारह सेकंड का वाक्य तीन आवाज़ों में 32 सेंट का पड़ता है, नौ क्रेडिट प्रति आवाज़।
वाक्य रिकॉर्ड या इंपोर्ट करें
फ़ोन का वॉइस मेमो काफ़ी है। वैसे बोलिए जैसे आप उसे कहलवाना चाहते हैं: चेंजर अभिनय की नक़ल करता है, शब्दों की नहीं। साफ़ टेक साफ़ नतीजा देता है; शोर वाला बैकग्राउंड पहले साफ़ होता है।
लक्ष्य आवाज़ चुनें
नोड के सेलेक्टर में इक्कीस आवाज़ें, महिला और पुरुष, जवान और बुज़ुर्ग। हर नोड की अपनी: एक ही स्रोत पर तीन नोड, तुलना के लिए तीन दावेदार।
टिंबर नहीं, लय सुनें
टिंबर चुनी हुई आवाज़ का होगा, यह तय है। परखना है अभिनय की वफ़ादारी: क्या अंत से पहले का ठहराव अब भी है, क्या सवाल अब भी ऊपर उठता है?
एडिट में भेजें या डाउनलोड करें
नोड का आउटपुट मोंटाज या किसी और प्रोसेस से जुड़ता है। डबिंग के लिए हर किरदार की एक आवाज़, हर एक अपने नोड में।
वही कैनवास, अलग-अलग ज़रूरतों के लिए सेट किया हुआ: हर वेरिएंट में प्रॉम्प्ट की बस दो-तीन लाइनें बदलनी होती हैं।
तीन आवाज़ों की कहानी, एक संवाद, एक फ़िक्शन पॉडकास्ट: सारे संवाद आप निभाते हैं, हर किरदार की एक लक्ष्य आवाज़, हर किरदार का एक नोड। अभिनय हर जगह आपका है, सिर्फ़ टिंबर भूमिकाओं को अलग करता है।
ऐसी गवाही जिसे आप प्रसारित करना चाहते हैं पर व्यक्ति पहचाना न जाए। आवाज़ पूरी बदल जाती है, भाव और लय रहते हैं: यह धीमी या बिगाड़ी आवाज़ से ज़्यादा ईमानदार है, और कहीं ज़्यादा सुनने लायक़।
आपको अपनी आवाज़ किसी वाचन के लिए बहुत जवान या बहुत पतली लगती है: उसे George या Roger से दोहराइए। आप अपना उच्चारण और अपनी ख़ामोशियाँ रखते हैं, वह टिंबर पाते हैं जो आपके पास नहीं।
सबसे हल्का और सबसे आम मामला। बच्चे या बूढ़े की आवाज़ में कहा जन्मदिन का संदेश, आपके शब्दों और हँसी के साथ। बता दीजिए कि यह खेल है: आवाज़ यक़ीन दिला देती है।
वीडियो में बोलने वाला ब्रांड किरदार: वाक्य ख़ुद रिकॉर्ड कीजिए, उन्हें हमेशा उसी लक्ष्य आवाज़ से गुज़ारिए, और किरदार एक वीडियो से दूसरे तक अपनी आवाज़ रखता है।
अगर आपके पास कोई रिकॉर्डिंग ही नहीं है, तो आपको वॉइस ओवर वर्कफ़्लो चाहिए: वह टेक्स्ट से पाठ बनाता है। चेंजर हमेशा इंसानी आवाज़ से शुरू करता है।
चेंजर उदाहरण में दी आवाज़ को नहीं दोहराता। इक्कीस आवाज़ें, सब ElevenLabs की लाइसेंस वाली, कोई असली व्यक्ति नहीं। «फलाँ की आवाज़» चाहना इस टूल के काम से बाहर है, और जो उसे करना चाहिए उससे भी बाहर।
शोर बदलता नहीं, वह एक बदली हुई आवाज़ के नीचे जस का तस रहता है: यह विरोधाभास उसे पहले से ज़्यादा सुनाई देने लायक़ बना देता है। पहले साफ़ करें, फिर बदलें।
चेंजर आपकी जगह अभिनय नहीं करता: नीरस पाठ नीरस लक्ष्य आवाज़ देता है। सारा अभिनय शुरुआती रिकॉर्डिंग में होना चाहिए, वही कमान सँभालती है।
चेंजर बोली के लिए बना है। गायन पर वह कभी सुर पकड़ता है, अक्सर नहीं, और पीछे का संगीत बिगड़कर निकलता है। गाने के लिए पहले ट्रैक सेपरेशन चाहिए।
नहीं, और यह एक फ़ैसला है। चेंजर आपकी रिकॉर्डिंग को लाइसेंस वाली ElevenLabs आवाज़ों में से एक में दोहराता है; वह नई आवाज़ नहीं सीखता और असली व्यक्ति की आवाज़ नहीं दोहराता। भेस बदलने के लिए हाँ; किसी की नक़ल के लिए नहीं।
वह आपका उच्चारण और स्वर रखती है, इसलिए काफ़ी हद तक आपका लहजा भी: चेंजर शब्द कहने के तरीक़े को नहीं छूता, सिर्फ़ टिंबर को। गहरा लहजा दूसरी आवाज़ में भी गहरा रहता है।
शोर नई आवाज़ में चला जाता है और और भी सुनाई देता है, क्योंकि टिंबर बदला और वह नहीं। पहले रिकॉर्डिंग साफ़ करें वर्कफ़्लो से साफ़ कीजिए, फिर आवाज़ बदलिए।
बयालीस क्रेडिट प्रति मिनट, सेकंड के हिसाब से। डेमो का वाक्य, तीन नोड में बारह सेकंड, सत्ताईस क्रेडिट का है, नौ प्रति आवाज़। क़ीमत क्लिक से पहले नोड पर दिखती है, आपकी फ़ाइल की मापी गई अवधि पर।
एक बार में दस मिनट। लंबी रिकॉर्डिंग मोंटाज में टुकड़ों में कटती है, जिससे सिर्फ़ सुधारा हुआ हिस्सा दोबारा चलाया जा सकता है।
सभी में: चेंजर शब्द नहीं समझता, वह ध्वनि बदलता है। जापानी या अरबी का वाक्य उसी उच्चारण के साथ जापानी या अरबी में निकलता है।
हाँ, और यही स्वाभाविक इस्तेमाल है: फ़ोन पर रिकॉर्ड किया वॉइस मेमो, मोबाइल कैनवास से नोड में इंपोर्ट। फ़ोन पर बनाएँ गाइड इशारे समझाती है।
नहीं। जो आप अपलोड करते हैं वह आपके वर्कस्पेस में रहता है और किसी ट्रेनिंग को नहीं सौंपा जाता, और आपकी फ़ाइलों से कोई आवाज़ नहीं सीखी जाती: चेंजर के पास बस उसकी इक्कीस आवाज़ें हैं।
AI से अपनी आवाज़ बदलें
यह वर्कफ़्लो इस्तेमाल करेंमुफ़्त अकाउंट, बिना क्रेडिट कार्ड। वर्कफ़्लो आपके कैनवास में पहले से भरा हुआ खुलता है।