tomai
लॉग इन
☁️ क्लाउड · क्रेडिट

वोकल सेपरेटर

न्यूरल स्टेम मॉडल से किसी भी गाने को वोकल्स और इंस्ट्रुमेंटल ट्रैक में बाँटें — झटपट कराओके

🪙 हमारे सर्वर पर न्यूरल स्टेम सेपरेशन: हर काम 5 क्रेडिट

🎙️ न्यूरल मॉडल ऑडियो को वोकल्स + इंस्ट्रुमेंटल (MP3) में बाँटता है। 10 मिनट तक के वीडियो सपोर्टेड हैं।

सर्वर पर FFmpeg हर फ़ॉर्मैट सँभालता है — वे HEVC/H.265 फ़ाइलें भी जो आपका ब्राउज़र नहीं चला पाता। फ़ाइलें 30 मिनट में सर्वर से हट जाती हैं।

Practice, remixes और karaoke के लिए stems

किसी भी track को vocals और instrumental में split करें — या drums और bass समेत चार stems में — अलग-अलग files के एक ZIP के रूप में deliver होता है।

🎙️

AI वोकल सेपरेशन

एक deep-learning मॉडल (Demucs) पूरे मिक्स को सुनकर ट्रैक को आवाज़ और संगीत में अलग करता है — फ़्रीक्वेंसी फ़िल्टर करके नहीं।

🎤

वोकल + इंस्ट्रुमेंटल

एक ही अपलोड से काराओके इंस्ट्रुमेंटल और साफ़ ऐकपेला दोनों पाएँ — किसी भी ट्रैक को रीमिक्स करें, कवर करें या उसका अभ्यास करें।

📦

दोनों ट्रैक एक ZIP में

दोनों अलग किए गए ट्रैक एक ही ZIP में डाउनलोड होते हैं — सीधे अपने DAW या video editor में इस्तेमाल के लिए तैयार।

अक्सर पूछे जाने वाले प्रश्न

सेपरेशन कितना अच्छा है?

Demucs फ़िलहाल सबसे मज़बूत ओपन-सोर्स स्टेम-स्प्लिटिंग मॉडल है। साफ़ स्टूडियो मिक्स में वोकल्स लगभग बिना इंस्ट्रुमेंट के निकल आते हैं। चरम मामलों — भारी रीवरब, डिस्टॉर्टेड वोकल, घने मेटल मिक्स — में स्टेम के बीच कुछ ब्लीडिंग दिखती है, जो किसी भी सोर्स-सेपरेशन मॉडल के लिए सामान्य है।

दो अलग डाउनलोड की जगह ZIP क्यों मिलता है?

दोनों स्टेम हमारे सर्वर पर साथ बनते हैं, और ZIP उन्हें जोड़कर रखता है और फ़ाइल नाम बरकरार रखता है। ZIP में बिल्कुल vocals.mp3 और instrumental.mp3 ही होते हैं।

लंबाई की क्या सीमा है?

हर काम में 10 मिनट — न्यूरल स्टेम सेपरेशन CPU-हैवी है, लंबे इनपुट से सर्वर की क्षमता खत्म हो जाएगी। लंबे गानों को पहले वीडियो ट्रिमर से काटकर हिस्सों में अलग किया जा सकता है।

Instrumental में vocals की हल्की आवाज़ क्यों रह जाती है?

Separation statistical process है, perfect नहीं — voice और instruments के बीच overlap होने वाली frequencies residue छोड़ जाती हैं। 4-stem model इसे 2-stem से आगे तक घटाता है; पूरी तरह साफ़ instrumentals के लिए sparse, center-panned vocals वाले tracks चुनें।

Source separation models और outputs

Separation worker CPU पर चलने वाले SDR-optimized neural network से होती है:

हर stem source के sample rate पर MP3 320 kbps में encode होता है (input lossless हो तो WAV) और सब एक ही ZIP में bundle होते हैं। 15 minutes तक की songs स्वीकार हैं। Stems के बीच bleed well-mastered pop/rock पर सबसे कम और dense electronic mixes पर ज़्यादा होता है — page यह पहले ही बता देती है, क्योंकि ईमानदार expectations surprise refunds से बेहतर होते हैं।

यह कैसे काम करता है

  1. 1

    गाना या वीडियो अपलोड करें — 10 मिनट तक, कोई भी ऑडियो फ़ॉर्मेट या ज़्यादातर वीडियो।

  2. 2

    काम शुरू करें। न्यूरल मॉडल मिक्स का विश्लेषण करके आवाज़ को संगीत से अलग करता है।

  3. 3

    vocals.mp3 और instrumental.mp3 वाला ZIP डाउनलोड करें। CPU प्रोसेसिंग लगभग गाने जितना ही समय लेती है।

संबंधित टूल

वोकल सेपरेशन क्या है?

वोकल सेपरेटर किसी भी गाने को दो साफ़ ट्रैक में बाँट देता है: अकेली आवाज़ और अकेला संगीत। किसी साधारण फ़िल्टर की तरह दूसरी आधी आवाज़ के अवशेष छोड़ने के बजाय, एक न्यूरल सोर्स-सेपरेशन मॉडल पूरे मिक्स को सुनता है और आवाज़ तथा वाद्ययंत्रों को अलग-अलग ऑडियो स्ट्रीम के रूप में फिर से बनाता है। 10 मिनट तक का ऑडियो फ़ाइल (या आवाज़ वाला वीडियो) अपलोड करें, और हमारा सर्वर vocals.mp3 और instrumental.mp3 युक्त एक ZIP फ़ाइल लौटाता है। गायक इससे बिना धुन के अभ्यास करते हैं, रीमिक्सर किसी हुक या बीट को अलग निकालते हैं, पॉडकास्ट एडिटर क्लिप से अनचाही आवाज़ हटाते हैं, और कराओके प्रेमियों को सेकंडों में बैकिंग ट्रैक मिल जाता है। सेपरेशन हमारे सर्वर पर ओपन-सोर्स Demucs मॉडल से होता है।

यह टूल क्या कर सकता है

  • 🎤 किसी भी गाने से आवाज़ अलग करके साफ़ अकेपेला ट्रैक पाएँ
  • 🎹 इंस्ट्रुमेंटल निकालें — पलक झपकते कराओके वर्ज़न
  • 📦 दोनों ट्रैक MP3 के रूप में एक ही ZIP में डाउनलोड करें
  • 🧠 न्यूरल मॉडल से स्टेम अलग करें जो मिक्स को समझता है, न कि साधारण फ़िल्टर
  • ⏱️ 10 मिनट तक के ऑडियो और वीडियो फ़ाइल स्वीकार करता है
  • 🗑️ अपलोड और परिणाम 30 मिनट में अपने आप मिट जाते हैं

इसका उपयोग कब करें

  • 🎤 गाने का अभ्यास: इंस्ट्रुमेंटल के साथ गाएँ या अलग की गई आवाज़ का अध्ययन करें
  • 🎶 घर पर कराओके नाइट करें, बिना माइनस-वन वर्ज़न ढूँढे
  • 🎧 साफ़ स्टेम से रीमिक्स और मैशअप बनाएँ
  • 🎙️ पॉडकास्ट या वीडियो साउंडट्रैक से आवाज़ हटाएँ
  • 🎓 संगीत सिखाएँ — आवाज़ और संगत अलग-अलग सुनकर

आपकी फ़ाइल हमारे VPS सर्वर पर भेजी जाती है, जहाँ Demucs न्यूरल नेटवर्क सेपरेशन करता है; अपलोड और परिणाम दोनों 30 मिनट में अपने आप हटा दिए जाते हैं। हर जॉब में क्रेडिट लगते हैं, और सर्वर के CPU पर मॉडल को लगभग उतना ही समय लगता है जितना गाना बजता है। हर जॉब में 10 मिनट तक का ऑडियो लिया जा सकता है — लंबे गानों को पहले ट्रिम टूल से काटकर हिस्सों में करें। साफ़ स्टूडियो मिक्स में स्टेम लगभग बिना किसी लीक के निकलते हैं; भारी रीवर्ब, डिस्टॉर्टेड वोकल या घने मेटल जैसी भारी प्रोसेस्ड रिकॉर्डिंग में थोड़ा क्रॉसटॉक हो सकता है — यह किसी भी सोर्स-सेपरेशन मॉडल की सामान्य विशेषता है।

संबंधित टूल