demucs ओपन-सोर्स मॉडल का उपयोग करके किसी भी गाने को एक क्लिक में vocals और instrumental स्टेम में अलग करें। पूरी तरह मुफ्त, कोई वॉटरमार्क नहीं, और न ही तीसरे पक्ष को अपलोड।
मुफ्त AI वोकल रिमूवर और कैरोके मेकर। अपने ब्राउज़र में किसी भी गाने को एक साफ vocal स्टेम और एक instrumental (कैरोके) स्टेम में अलग करें। Meta के ओपन-सोर्स demucs मॉडल (htdemucs_ft) पर बनाया गया है, जो वही AI है जिसे ऑडियो इंजीनियर म्यूजिक प्रोडक्शन में इस्तेमाल करते हैं। न अकाउंट, न वॉटरमार्क — ऑडियो हमारे सर्वर पर प्रोसेस होता है, और स्टेम एक ZIP फाइल में आते हैं।
फाइल को यहाँ खींचकर छोड़ें, या चुनने के लिए क्लिक करें
गोपनीयता: हम आपकी ऑडियो फाइलें स्टोर या शेयर नहीं करते — प्रोसेसिंग पूरी होने पर स्वचालित रूप से हटा दी जाती हैं।
नोट: प्रोसेसिंग हमारे CPU सर्वर पर होती है, हर गाने के लिए आमतौर पर 1-3 मिनट लग सकते हैं।
वोकल सेपरेशन क्या है?
वोकल सेपरेशन क्या है?
वोकल सेपरेशन (जिसे वोकल रिमूवल या स्टेम सेपरेशन भी कहते हैं) एक तैयार गाने को दो हिस्सों में बाँटने की प्रक्रिया है: vocals — गायन, रैप या बोलना — और instrumental (बाकी सब: ड्रम, बेस, गिटार, कीबोर्ड, सिंथ)। यह वही तकनीक है जो लाइव बैंड के बिना कैरोके को संभव बनाती है, और निर्माताओं को उन गानों को सैंपल, रीमिक्स या कवर करने देती है जो कभी अलग ट्रैक के रूप में रिलीज़ नहीं हुए।
2010 के दशक के अंत तक इसके लिए या तो स्टूडियो के मूल मल्टी-ट्रैक्स तक पहुँच (दुर्लभ) चाहिए थी, या phase-cancellation की तरकीबें जो केवल मोनो रिकॉर्डिंग पर काम करती थीं। demucs जैसे आधुनिक AI मॉडल एक पूरी तरह मिक्स किए हुए गाने को इनपुट के रूप में लेते हैं और दो साफ स्टेम बनाते हैं — भारी रिवर्ब, side-chain कम्प्रेशन, या स्तरित बैकिंग vocals वाले ट्रैक पर भी।
इस टूल का उपयोग कैसे करें
अपनी ऑडियो तैयार करें। सभी सामान्य फॉर्मेट काम करते हैं — MP3, WAV, FLAC, OGG, M4A, AAC, OPUS, WMA, AIFF, M4B। सैंपल रेट स्वचालित रूप से नॉर्मलाइज़ हो जाती है; बिट डेप्थ संरक्षित रहती है।
ऊपर अपलोड बॉक्स में फाइल ड्रॉप करें, या ब्राउज़ करने के लिए क्लिक करें। चुनी गई फाइल का नाम बॉक्स के नीचे दिखाई देगा।
एक आउटपुट फॉर्मेट चुनें। किसी भी डिवाइस पर चलाने के लिए छोटी फाइल चाहिए तो MP3, या DAW में आगे संपादन के लिए अनकंप्रेस्ड मास्टर चाहिए तो WAV चुनें।
अलग करें पर क्लिक करें। ब्राउज़र फाइल को हमारे सर्वर पर अपलोड करता है, जहाँ AI मॉडल (htdemucs_ft) इसे प्रोसेस करता है। प्रगति बार टूल के पहले उपयोग पर "AI मॉडल लोड हो रहा है" चरण दिखाता है, फिर गाने के विश्लेषण के दौरान "vocals और instrumental अलग किए जा रहे हैं" दिखाता है। 3 मिनट का गाना आमतौर पर 60–180 सेकंड लेता है।
ZIP डाउनलोड करें। काम पूरा होने पर, दोनों स्टेम वाला एक संग्रह सहेजने के लिए ZIP डाउनलोड करें (vocals + instrumental) पर क्लिक करें। दोनों स्टेम स्रोत फाइल की टेम्पो और पिच साझा करते हैं — सीधे प्रोजेक्ट में डालने के लिए तैयार।
बेहतरीन परिणामों के लिए सुझाव
जितना हो सके उच्च-गुणवत्ता वाला स्रोत उपयोग करें। 128 kbps MP3 जैसे lossy फॉर्मेट ऐसे कलाकृतियाँ (artefacts) लाते हैं जिन्हें AI ठीक नहीं कर सकता। 320 kbps MP3, AAC, FLAC या WAV स्रोत हमेशा उल्लेखनीय रूप से स्वच्छ सुनाई देते हैं।
छोटे क्लिप तेज़ी और बेहतर अलग होते हैं। यदि आपको केवल कोरस या वर्स चाहिए, तो पहले अपने DAW में संबंधित हिस्सा काट लें; मॉडल पूरी फाइल का विश्लेषण करता है।
मोनो ठीक है। अधिकांश पॉप, रॉक और हिप-हॉप रिलीज़ स्टीरियो में मिक्स की जाती हैं, लेकिन AI मोनो स्रोतों को भी उतनी ही अच्छी तरह संभालता है।
भारी मास्टरिंग आपका दुश्मन है। loudness-war ट्रैक जिन्हें brick-wall-limited किया गया है, मॉडल जिन स्थानिक संकेतों पर निर्भर करता है उन्हें हटा देते हैं। पेशेवर रूप से मिक्स किया गया लेकिन मास्टर नहीं किया गया गाना आमतौर पर -8 LUFS लिमिटिंग के बाद उसी गाने से बहुत बेहतर अलग होता है।
यहाँ "instrumental" का वास्तव में क्या अर्थ है
demucs htdemucs_ft एक हाइब्रिड ट्रांसफ़ॉर्मर है जो गाने को चार आंतरिक स्रोतों में बाँटता है — vocals, drums, bass और other (गिटार, की, सिंथ, कुछ भी और)। हमारा उपयोग किया जाने वाला "--two-stems vocals" मोड दो स्टेम लौटाता है:
Vocals = मॉडल का vocal पूर्वानुमान।
Instrumental = मूल गाना घटाव vocal पूर्वानुमान। यह इनपुट से vocals घटाकर गणना किया जाता है, जो कुछ आवृत्तियों पर instrumental को "खोखला" बनाता है — यह सामान्य है, और हर AI वोकल रिमूवर वही कलाकृति पैदा करता है।
यदि आपको बारीक स्टेम चाहिए (केवल ड्रम, केवल बेस, आदि), तो पूर्ण demucs मॉडल उन्हें एक अलग विकल्प के रूप में उजागर करता है; दो-स्टेम मोड वह है जो अधिकांश कैरोके और रीमिक्स वर्कफ़्लो को चाहिए।
सामान्य उपयोग
कैरोके बैकिंग ट्रैक — instrumental को अपने कैरोके ऐप में डालें।
Acapella निष्कर्षण mashup और रीमिक्स के लिए।
सैंपलिंग — एक तैयार रिकॉर्ड से एक स्वच्छ vocal या instrumental लूप खींचें।
अभ्यास और शिक्षण — instrumental के साथ गाएँ, फिर अपने कवर की मूल acapella से तुलना करें।
ऑडियो पुनर्स्थापना — बैकिंग ट्रैक को छुए बिना सफ़ाई, शोर कमी या पिच सुधार के लिए vocals को अलग करें।
तकनीकी नोट
मॉडल हमारे सर्वर पर केवल CPU पर चलता है। एक ताज़ा कंटेनर शुरू होने के बाद पहला अनुरोध मेमोरी में 340 MB मॉडल भार लोड करने में लगभग 20–30 सेकंड लगाता है; बाद के अनुरोध तुरंत प्रोसेसिंग शुरू करते हैं। सर्वर की प्रोसेसिंग सीमा (वर्तमान में 50 MB) से लंबी ऑडियो अस्वीकार कर दी जाएगी — यदि आवश्यक हो तो पहले लंबी फाइलों को विभाजित करें।
यदि आप वोकल सेपरेटर, कैरोके मेकर, गाने से vocals हटाने का टूल, instrumental एक्सट्रैक्टर, या सिंगर अलग करने का टूल खोज रहे हैं, तो यह टूल इसी उद्देश्य के लिए बनाया गया है।
अक्सर पूछे जाने वाले प्रश्न
क्या यह वोकल रिमूवर मुफ्त है?
हाँ — न अकाउंट, न भुगतान, न वॉटरमार्क। पृष्ठ को गैर-बाधक विज्ञापनों से वित्तपोषित किया जाता है और सर्वर की लागत हम वहन करते हैं।
क्या मेरी ऑडियो अपलोड या शेयर की जाती है?
फाइल अलगाव कार्य की अवधि के लिए हमारे सर्वर पर अपलोड की जाती है और तुरंत हटा दी जाती है। हम आपकी ऑडियो को स्टोर, ट्रांसकोड, शेयर या विश्लेषित नहीं करते — स्टेम बनाने के लिए आवश्यक से आगे।
कौन से ऑडियो फॉर्मेट समर्थित हैं?
MP3, WAV, FLAC, OGG, M4A, AAC, OPUS, WMA, AIFF और M4B। बिट डेप्थ और सैंपल रेट स्वचालित रूप से नॉर्मलाइज़ हो जाती हैं।
क्या यह ड्रम या बेस जैसे अलग-अलग वाद्य यंत्रों को अलग कर सकता है?
इस टूल में नहीं — अंतर्निहित मॉडल सबसे आम उपयोग के मामले (vocals बनाम बाकी सब) के लिए कॉन्फ़िगर किया गया है। पूर्ण चार-स्टेम मोड (vocals, drums, bass, other) अपस्ट्रीम demucs प्रोजेक्ट में उपलब्ध है।
पहला अनुरोध इतना लंबा क्यों होता है?
एक ताज़ा सर्वर शुरू होने के बाद पहला वोकल-सेपरेटर अनुरोध मेमोरी में 340 MB AI मॉडल लोड करने में लगभग 20–30 सेकंड लेता है। बाद के अनुरोध तुरंत शुरू होते हैं। प्रगति बार इस चरण के दौरान "AI मॉडल लोड हो रहा है" दिखाता है ताकि आप जान सकें कि यह रुका नहीं है।
मुझे MP3 या WAV आउटपुट चुनना चाहिए?
MP3 बहुत छोटा होता है और कैरोके या आकस्मिक सुनने के लिए ठीक है। WAV अनकंप्रेस्ड है और यही वह है जिसे आप चाहते हैं यदि आप DAW में स्टेम को आगे संपादित करना चाहते हैं, क्योंकि lossy कम्प्रेशन ऐसी कलाकृतियाँ जोड़ता है जो आगे की प्रोसेसिंग में भी बनी रहती हैं।
अलगाव में कितना समय लगता है?
हमारे CPU सर्वर पर 3 मिनट का गाना आमतौर पर 60–180 सेकंड लेता है। बहुत लंबी फाइलें (10 मिनट से अधिक) प्रति-कार्य सीमा से अधिक हो सकती हैं; यदि आपको लंबे खंड चाहिए तो पहले फाइल को विभाजित करें।
यदि मेरे गाने से पहले से ही vocals हटा दिए गए हैं तो क्या होगा?
यदि इनपुट पूरी तरह instrumental है, तो "vocals" स्टेम मूक होगा (या लगभग-मूक हिस) और "instrumental" स्टेम इनपुट के समान होगा।