वोकल सेपरेटर
न्यूरल स्टेम मॉडल से किसी भी गाने को वोकल्स और इंस्ट्रुमेंटल ट्रैक में बाँटें — झटपट कराओके
🎙️ न्यूरल मॉडल ऑडियो को वोकल्स + इंस्ट्रुमेंटल (MP3) में बाँटता है। 10 मिनट तक के वीडियो सपोर्टेड हैं।
सर्वर पर FFmpeg हर फ़ॉर्मैट सँभालता है — वे HEVC/H.265 फ़ाइलें भी जो आपका ब्राउज़र नहीं चला पाता। फ़ाइलें 30 मिनट में सर्वर से हट जाती हैं।
⚠️ काम पूरा होने तक यह पेज बंद या रिफ़्रेश न करें, वरना नतीजा खो सकता है।
💡 बड़ी फ़ाइलें आपके कनेक्शन की रफ़्तार से सफ़र करती हैं: अपलोड ख़ुद-ब-ख़ुद आगे बढ़ता है और सुरक्षित रूप से resume होता है, इसलिए धीमा नेटवर्क सिर्फ़ समय पर असर डालता है — आपके क्रेडिट्स पर कभी नहीं।
Practice, remixes और karaoke के लिए stems
किसी भी track को vocals और instrumental में split करें — या drums और bass समेत चार stems में — अलग-अलग files के एक ZIP के रूप में deliver होता है।
AI वोकल सेपरेशन
एक deep-learning मॉडल (Demucs) पूरे मिक्स को सुनकर ट्रैक को आवाज़ और संगीत में अलग करता है — फ़्रीक्वेंसी फ़िल्टर करके नहीं।
वोकल + इंस्ट्रुमेंटल
एक ही अपलोड से काराओके इंस्ट्रुमेंटल और साफ़ ऐकपेला दोनों पाएँ — किसी भी ट्रैक को रीमिक्स करें, कवर करें या उसका अभ्यास करें।
दोनों ट्रैक एक ZIP में
दोनों अलग किए गए ट्रैक एक ही ZIP में डाउनलोड होते हैं — सीधे अपने DAW या video editor में इस्तेमाल के लिए तैयार।
अक्सर पूछे जाने वाले प्रश्न
सेपरेशन कितना अच्छा है?⌄
Demucs फ़िलहाल सबसे मज़बूत ओपन-सोर्स स्टेम-स्प्लिटिंग मॉडल है। साफ़ स्टूडियो मिक्स में वोकल्स लगभग बिना इंस्ट्रुमेंट के निकल आते हैं। चरम मामलों — भारी रीवरब, डिस्टॉर्टेड वोकल, घने मेटल मिक्स — में स्टेम के बीच कुछ ब्लीडिंग दिखती है, जो किसी भी सोर्स-सेपरेशन मॉडल के लिए सामान्य है।
दो अलग डाउनलोड की जगह ZIP क्यों मिलता है?⌄
दोनों स्टेम हमारे सर्वर पर साथ बनते हैं, और ZIP उन्हें जोड़कर रखता है और फ़ाइल नाम बरकरार रखता है। ZIP में बिल्कुल vocals.mp3 और instrumental.mp3 ही होते हैं।
लंबाई की क्या सीमा है?⌄
हर काम में 10 मिनट — न्यूरल स्टेम सेपरेशन CPU-हैवी है, लंबे इनपुट से सर्वर की क्षमता खत्म हो जाएगी। लंबे गानों को पहले वीडियो ट्रिमर से काटकर हिस्सों में अलग किया जा सकता है।
Instrumental में vocals की हल्की आवाज़ क्यों रह जाती है?⌄
Separation statistical process है, perfect नहीं — voice और instruments के बीच overlap होने वाली frequencies residue छोड़ जाती हैं। 4-stem model इसे 2-stem से आगे तक घटाता है; पूरी तरह साफ़ instrumentals के लिए sparse, center-panned vocals वाले tracks चुनें।
Source separation models और outputs
Separation worker CPU पर चलने वाले SDR-optimized neural network से होती है:
- 2-stem mode — vocals vs accompaniment; सबसे तेज़, karaoke tracks और cover-along practice के लिए ideal।
- 4-stem mode — remix work और sample hunting के लिए drums और bass भी अलग करता है; processing time लगभग double हो जाता है।
हर stem source के sample rate पर MP3 320 kbps में encode होता है (input lossless हो तो WAV) और सब एक ही ZIP में bundle होते हैं। 15 minutes तक की songs स्वीकार हैं। Stems के बीच bleed well-mastered pop/rock पर सबसे कम और dense electronic mixes पर ज़्यादा होता है — page यह पहले ही बता देती है, क्योंकि ईमानदार expectations surprise refunds से बेहतर होते हैं।
यह कैसे काम करता है
- 1
गाना या वीडियो अपलोड करें — 10 मिनट तक, कोई भी ऑडियो फ़ॉर्मेट या ज़्यादातर वीडियो।
- 2
काम शुरू करें। न्यूरल मॉडल मिक्स का विश्लेषण करके आवाज़ को संगीत से अलग करता है।
- 3
vocals.mp3 और instrumental.mp3 वाला ZIP डाउनलोड करें। CPU प्रोसेसिंग लगभग गाने जितना ही समय लेती है।
संबंधित टूल
वोकल सेपरेशन क्या है?
वोकल सेपरेटर किसी भी गाने को दो साफ़ ट्रैक में बाँट देता है: अकेली आवाज़ और अकेला संगीत। किसी साधारण फ़िल्टर की तरह दूसरी आधी आवाज़ के अवशेष छोड़ने के बजाय, एक न्यूरल सोर्स-सेपरेशन मॉडल पूरे मिक्स को सुनता है और आवाज़ तथा वाद्ययंत्रों को अलग-अलग ऑडियो स्ट्रीम के रूप में फिर से बनाता है। 10 मिनट तक का ऑडियो फ़ाइल (या आवाज़ वाला वीडियो) अपलोड करें, और हमारा सर्वर vocals.mp3 और instrumental.mp3 युक्त एक ZIP फ़ाइल लौटाता है। गायक इससे बिना धुन के अभ्यास करते हैं, रीमिक्सर किसी हुक या बीट को अलग निकालते हैं, पॉडकास्ट एडिटर क्लिप से अनचाही आवाज़ हटाते हैं, और कराओके प्रेमियों को सेकंडों में बैकिंग ट्रैक मिल जाता है। सेपरेशन हमारे सर्वर पर ओपन-सोर्स Demucs मॉडल से होता है।
यह टूल क्या कर सकता है
- 🎤 किसी भी गाने से आवाज़ अलग करके साफ़ अकेपेला ट्रैक पाएँ
- 🎹 इंस्ट्रुमेंटल निकालें — पलक झपकते कराओके वर्ज़न
- 📦 दोनों ट्रैक MP3 के रूप में एक ही ZIP में डाउनलोड करें
- 🧠 न्यूरल मॉडल से स्टेम अलग करें जो मिक्स को समझता है, न कि साधारण फ़िल्टर
- ⏱️ 10 मिनट तक के ऑडियो और वीडियो फ़ाइल स्वीकार करता है
- 🗑️ अपलोड और परिणाम 30 मिनट में अपने आप मिट जाते हैं
इसका उपयोग कब करें
- 🎤 गाने का अभ्यास: इंस्ट्रुमेंटल के साथ गाएँ या अलग की गई आवाज़ का अध्ययन करें
- 🎶 घर पर कराओके नाइट करें, बिना माइनस-वन वर्ज़न ढूँढे
- 🎧 साफ़ स्टेम से रीमिक्स और मैशअप बनाएँ
- 🎙️ पॉडकास्ट या वीडियो साउंडट्रैक से आवाज़ हटाएँ
- 🎓 संगीत सिखाएँ — आवाज़ और संगत अलग-अलग सुनकर
आपकी फ़ाइल हमारे VPS सर्वर पर भेजी जाती है, जहाँ Demucs न्यूरल नेटवर्क सेपरेशन करता है; अपलोड और परिणाम दोनों 30 मिनट में अपने आप हटा दिए जाते हैं। हर जॉब में क्रेडिट लगते हैं, और सर्वर के CPU पर मॉडल को लगभग उतना ही समय लगता है जितना गाना बजता है। हर जॉब में 10 मिनट तक का ऑडियो लिया जा सकता है — लंबे गानों को पहले ट्रिम टूल से काटकर हिस्सों में करें। साफ़ स्टूडियो मिक्स में स्टेम लगभग बिना किसी लीक के निकलते हैं; भारी रीवर्ब, डिस्टॉर्टेड वोकल या घने मेटल जैसी भारी प्रोसेस्ड रिकॉर्डिंग में थोड़ा क्रॉसटॉक हो सकता है — यह किसी भी सोर्स-सेपरेशन मॉडल की सामान्य विशेषता है।
संबंधित टूल
क्लाउड ऑडियो स्टूडियो
ऑडियो फ़ाइलों को परिवर्तित करें, संपीड़ित करें, काटें, आवाज़ समायोजित करें, चुप्पी हटाएं, गति बदलें, फ़ेड करें, उलटें, लूप करें और दृश्यात्मक रूप से प्रदर्शित करें।
ऑडियो मर्ज करें
आपके चुने क्रम में 2-6 ऑडियो क्लिप्स को एक फ़ाइल में मिलाएं
ऑडियो से टेक्स्ट
किसी भी वीडियो या ऑडियो फ़ाइल की बोली को सादे टेक्स्ट में बदलें — Qwen3-ASR की मदद से