सभी टूल

AI से अपनी आवाज़ बदलें

एक पुरुष आवाज़ में कहा गया वाक्य, ElevenLabs Voice Changer से तीन आवाज़ों में दोबारा, एक महिला, एक युवा पुरुष, एक बड़ी उम्र का पुरुष, मूल लय और स्वर के साथ। पूरा वर्कफ़्लो, बिना खाता बनाए।

इंटरैक्टिव डेमो

असली वर्कफ़्लो, असली नतीजे। खुलकर घुमाइए और ज़ूम कीजिए।

यह वर्कफ़्लो इस्तेमाल करें

असली वर्कफ़्लो: वही वाक्य तीन «आवाज़ सुधारें» नोड में जाता है, हर एक पर एक लक्ष्य आवाज़ सेट, और आप सुनते हैं क्या बदलता है और क्या रहता है।

एक नज़र में

यह वर्कफ़्लो क्या बनाता है
3 प्रोसेस की गई ऑडियो फ़ाइलें
कैनवास की बनावट
0 कनेक्शन से जुड़े 4 नोड
जुड़े हुए मॉडल
ElevenLabs Voice Changer
एक पूरे राउंड का ख़र्च
लगभग 27 क्रेडिट, यानी $0.32

जब सिर्फ़ एक आवाज़ हो और डब करने को एक किरदार, कोई वॉइस ओवर जिसे आप भारी या जवान चाहते हैं, कोई वॉइस मैसेज जिसे गुमनाम करना हो: वॉइस चेंजर एक साधारण रिकॉर्डिंग से यह सब करता है। यह वर्कफ़्लो उसे ElevenLabs Voice Changer से तीन लक्ष्य आवाज़ों के साथ अगल-बगल गुज़ारता है, ताकि एक साथ सुन सकें कि क्या बदलता है और क्या बचता है।

जो बचता है वही असल है: लय, ठहराव, हिचक, स्वर। चेंजर वाक्य को दोबारा नहीं लिखता, उसे दूसरे टिंबर में दोहराता है। डेमो के वाक्य में एक सवाल, एक ठहराव और एक अंत है, और तीनों आवाज़ें उन्हें हूबहू दोहराती हैं। यह स्पीच सिंथेसिस नहीं है: यह आपका अभिनय है, दूसरे गले में।

ElevenLabs की इक्कीस आवाज़ें चुनने को, और कोई निजी आवाज़ नहीं: यह टूल भेस बदलता है, क्लोन नहीं करता। आपकी फ़ाइल नोड के इंपोर्ट बटन से आती है, एक बार में दस मिनट तक, सेकंड के हिसाब से: बारह सेकंड का वाक्य तीन आवाज़ों में 32 सेंट का पड़ता है, नौ क्रेडिट प्रति आवाज़।

कैसे करें

  1. 1

    वाक्य रिकॉर्ड या इंपोर्ट करें

    फ़ोन का वॉइस मेमो काफ़ी है। वैसे बोलिए जैसे आप उसे कहलवाना चाहते हैं: चेंजर अभिनय की नक़ल करता है, शब्दों की नहीं। साफ़ टेक साफ़ नतीजा देता है; शोर वाला बैकग्राउंड पहले साफ़ होता है।

  2. 2

    लक्ष्य आवाज़ चुनें

    नोड के सेलेक्टर में इक्कीस आवाज़ें, महिला और पुरुष, जवान और बुज़ुर्ग। हर नोड की अपनी: एक ही स्रोत पर तीन नोड, तुलना के लिए तीन दावेदार।

  3. 3

    टिंबर नहीं, लय सुनें

    टिंबर चुनी हुई आवाज़ का होगा, यह तय है। परखना है अभिनय की वफ़ादारी: क्या अंत से पहले का ठहराव अब भी है, क्या सवाल अब भी ऊपर उठता है?

  4. 4

    एडिट में भेजें या डाउनलोड करें

    नोड का आउटपुट मोंटाज या किसी और प्रोसेस से जुड़ता है। डबिंग के लिए हर किरदार की एक आवाज़, हर एक अपने नोड में।

वेरिएंट और इस्तेमाल के तरीके

वही कैनवास, अलग-अलग ज़रूरतों के लिए सेट किया हुआ: हर वेरिएंट में प्रॉम्प्ट की बस दो-तीन लाइनें बदलनी होती हैं।

अकेले कई किरदार डब करना

तीन आवाज़ों की कहानी, एक संवाद, एक फ़िक्शन पॉडकास्ट: सारे संवाद आप निभाते हैं, हर किरदार की एक लक्ष्य आवाज़, हर किरदार का एक नोड। अभिनय हर जगह आपका है, सिर्फ़ टिंबर भूमिकाओं को अलग करता है।

किसी गवाही को गुमनाम बनाना

ऐसी गवाही जिसे आप प्रसारित करना चाहते हैं पर व्यक्ति पहचाना न जाए। आवाज़ पूरी बदल जाती है, भाव और लय रहते हैं: यह धीमी या बिगाड़ी आवाज़ से ज़्यादा ईमानदार है, और कहीं ज़्यादा सुनने लायक़।

ज़्यादा भारी या ठहरी हुई वॉइस ओवर

आपको अपनी आवाज़ किसी वाचन के लिए बहुत जवान या बहुत पतली लगती है: उसे George या Roger से दोहराइए। आप अपना उच्चारण और अपनी ख़ामोशियाँ रखते हैं, वह टिंबर पाते हैं जो आपके पास नहीं।

मज़ाक़ के लिए भेस बदला वॉइस मैसेज

सबसे हल्का और सबसे आम मामला। बच्चे या बूढ़े की आवाज़ में कहा जन्मदिन का संदेश, आपके शब्दों और हँसी के साथ। बता दीजिए कि यह खेल है: आवाज़ यक़ीन दिला देती है।

असिस्टेंट या मैस्कॉट की आवाज़

वीडियो में बोलने वाला ब्रांड किरदार: वाक्य ख़ुद रिकॉर्ड कीजिए, उन्हें हमेशा उसी लक्ष्य आवाज़ से गुज़ारिए, और किरदार एक वीडियो से दूसरे तक अपनी आवाज़ रखता है।

वही टेक्स्ट मशीन से पढ़वाना

अगर आपके पास कोई रिकॉर्डिंग ही नहीं है, तो आपको वॉइस ओवर वर्कफ़्लो चाहिए: वह टेक्स्ट से पाठ बनाता है। चेंजर हमेशा इंसानी आवाज़ से शुरू करता है।

आम ग़लतियाँ

क्लोन की उम्मीद

चेंजर उदाहरण में दी आवाज़ को नहीं दोहराता। इक्कीस आवाज़ें, सब ElevenLabs की लाइसेंस वाली, कोई असली व्यक्ति नहीं। «फलाँ की आवाज़» चाहना इस टूल के काम से बाहर है, और जो उसे करना चाहिए उससे भी बाहर।

शोर वाले बैकग्राउंड पर आवाज़ बदलना

शोर बदलता नहीं, वह एक बदली हुई आवाज़ के नीचे जस का तस रहता है: यह विरोधाभास उसे पहले से ज़्यादा सुनाई देने लायक़ बना देता है। पहले साफ़ करें, फिर बदलें।

लक्ष्य आवाज़ के भरोसे सपाट बोलना

चेंजर आपकी जगह अभिनय नहीं करता: नीरस पाठ नीरस लक्ष्य आवाज़ देता है। सारा अभिनय शुरुआती रिकॉर्डिंग में होना चाहिए, वही कमान सँभालती है।

गाना गुज़ारना

चेंजर बोली के लिए बना है। गायन पर वह कभी सुर पकड़ता है, अक्सर नहीं, और पीछे का संगीत बिगड़कर निकलता है। गाने के लिए पहले ट्रैक सेपरेशन चाहिए।

सुझाए गए मॉडल

अक्सर पूछे जाने वाले सवाल

क्या मैं अपनी आवाज़ को लक्ष्य बना सकता हूँ?

नहीं, और यह एक फ़ैसला है। चेंजर आपकी रिकॉर्डिंग को लाइसेंस वाली ElevenLabs आवाज़ों में से एक में दोहराता है; वह नई आवाज़ नहीं सीखता और असली व्यक्ति की आवाज़ नहीं दोहराता। भेस बदलने के लिए हाँ; किसी की नक़ल के लिए नहीं।

क्या आवाज़ मेरा लहजा रखती है?

वह आपका उच्चारण और स्वर रखती है, इसलिए काफ़ी हद तक आपका लहजा भी: चेंजर शब्द कहने के तरीक़े को नहीं छूता, सिर्फ़ टिंबर को। गहरा लहजा दूसरी आवाज़ में भी गहरा रहता है।

अगर रिकॉर्डिंग में शोर हो?

शोर नई आवाज़ में चला जाता है और और भी सुनाई देता है, क्योंकि टिंबर बदला और वह नहीं। पहले रिकॉर्डिंग साफ़ करें वर्कफ़्लो से साफ़ कीजिए, फिर आवाज़ बदलिए।

आवाज़ बदलने का ख़र्च कितना है?

बयालीस क्रेडिट प्रति मिनट, सेकंड के हिसाब से। डेमो का वाक्य, तीन नोड में बारह सेकंड, सत्ताईस क्रेडिट का है, नौ प्रति आवाज़। क़ीमत क्लिक से पहले नोड पर दिखती है, आपकी फ़ाइल की मापी गई अवधि पर।

अधिकतम अवधि कितनी है?

एक बार में दस मिनट। लंबी रिकॉर्डिंग मोंटाज में टुकड़ों में कटती है, जिससे सिर्फ़ सुधारा हुआ हिस्सा दोबारा चलाया जा सकता है।

यह किन भाषाओं में काम करता है?

सभी में: चेंजर शब्द नहीं समझता, वह ध्वनि बदलता है। जापानी या अरबी का वाक्य उसी उच्चारण के साथ जापानी या अरबी में निकलता है।

क्या फ़ोन से किया जा सकता है?

हाँ, और यही स्वाभाविक इस्तेमाल है: फ़ोन पर रिकॉर्ड किया वॉइस मेमो, मोबाइल कैनवास से नोड में इंपोर्ट। फ़ोन पर बनाएँ गाइड इशारे समझाती है।

क्या मेरी रिकॉर्डिंग से मॉडल ट्रेन होते हैं?

नहीं। जो आप अपलोड करते हैं वह आपके वर्कस्पेस में रहता है और किसी ट्रेनिंग को नहीं सौंपा जाता, और आपकी फ़ाइलों से कोई आवाज़ नहीं सीखी जाती: चेंजर के पास बस उसकी इक्कीस आवाज़ें हैं।

AI से अपनी आवाज़ बदलें

यह वर्कफ़्लो इस्तेमाल करें

मुफ़्त अकाउंट, बिना क्रेडिट कार्ड। वर्कफ़्लो आपके कैनवास में पहले से भरा हुआ खुलता है।