Разделение вокала
Разделяйте любую песню на вокал и инструментал нейронной моделью — мгновенный караоке
🎙️ Нейронная модель разделяет аудио на вокал + инструментал (MP3). Поддерживаются видео до 10 минут.
Серверный FFmpeg обрабатывает любой формат — включая файлы HEVC/H.265, которые ваш браузер не воспроизводит. Файлы удаляются с сервера в течение 30 минут.
⚠️ Не закрывайте и не обновляйте эту страницу до завершения — иначе результат может быть потерян.
💡 Большие файлы едут со скоростью вашего соединения: загрузка продолжается сама и безопасно возобновляется, поэтому медленная сеть влияет только на время — но никогда на ваши кредиты.
Дорожки для репетиций, ремиксов и караоке
Разделите любой трек на вокал и минус — или на четыре дорожки, включая барабаны и бас, — с доставкой в виде ZIP из отдельных файлов.
AI-разделение вокала
Модель глубокого обучения (Demucs) разделяет трек на голос и музыку, анализируя микс целиком, — а не простым фильтрованием частот.
Вокал + минусовка
Из одной загрузки получаете минусовку для караоке и чистую акапеллу — ремикшируйте, делайте каверы или разбирайте любую из дорожек.
ZIP с обеими дорожками
Обе разделённые дорожки скачиваются одним ZIP-архивом — готовы к импорту в вашу DAW или видеоредактор.
Частые вопросы
Насколько хорошее разделение?⌄
Demucs — самая сильная открытая модель разделения дорожек. На чистых студийных миксах вокал выходит практически без инструментов. В крайних случаях — сильная реверберация, искажённый вокал, плотные метал-миксы — между дорожками появляется небольшое смешивание, что нормально для любой модели разделения источников.
Почему ZIP, а не два отдельных скачивания?⌄
Обе дорожки создаются вместе на нашем сервере, а ZIP сохраняет их в паре и сохраняет имена файлов. В архиве ровно vocals.mp3 и instrumental.mp3.
Какое ограничение по длительности?⌄
10 минут на задачу — нейронное разделение дорожек требовательно к CPU, более длинные входы исчерпали бы мощность сервера. Более длинные песни можно сначала обрезать инструментом обрезки видео и разделить по частям.
Почему в минусе всё ещё едва слышен вокал?⌄
Разделение статистично, а не идеально — частоты, пересекающиеся между голосом и инструментами, оставляют остаточный сигнал. Модель на 4 дорожки снижает его сильнее, чем модель на 2; для полностью чистого минуса выбирайте треки с редким вокалом по центру стереопанорамы.
Модели разделения источников и результаты
Для разделения используется нейросеть, оптимизированная по SDR и выполняемая на CPU воркера:
- Режим 2 дорожек — вокал против аккомпанемента; самый быстрый, идеален для караоке-минусовок и занятий каверами.
- Режим 4 дорожек — дополнительно выделяет барабаны и бас для ремиксов и охоты за сэмплами; время обработки возрастает примерно вдвое.
Каждая дорожка кодируется на исходной частоте дискретизации в MP3 320 kbps (или WAV, если источник был без потерь) и упаковывается в один ZIP. Принимаются песни длительностью до 15 минут. Просачивание между дорожками минимально на хорошо сведённых записях поп/рок и выше на плотных электронных миксах — страница предупреждает об этом заранее, потому что честные ожидания лучше неожиданных возвратов средств.
Как это работает
- 1
Загрузите песню или видео — до 10 минут, любой аудиоформат или большинство видео.
- 2
Запустите задачу. Нейронная модель анализирует микс и отделяет голос от инструментовки.
- 3
Скачайте ZIP-архив с vocals.mp3 и instrumental.mp3. Обработка на CPU занимает примерно столько же времени, сколько длится сама песня.
Похожие инструменты
Что такое разделение вокала?
Разделитель вокала разбирает песню на два чистых трека: только голос и только музыку. Вместо грубой фильтрации, оставляющей следы второй половины, нейросетевая модель разделения источников прослушивает весь микс и восстанавливает вокал и инструменты как отдельные аудиопотоки. Загрузите аудиофайл — или видео со звуком — длительностью до 10 минут, и наш сервер вернёт ZIP-архив с vocals.mp3 и instrumental.mp3. Певцы репетируют без мелодии, ремиксеры изолируют припев или бит, редакторы подкастов убирают лишние голоса из фрагмента, а любители караоке за секунды получают минусовку. Само разделение выполняется на нашем сервере с помощью модели Demucs с открытым исходным кодом.
Что умеет этот инструмент
- 🎤 Выделить голос из любой песни в чистый акапелла-трек
- 🎹 Извлечь инструментал — готовую караоке-версию за секунды
- 📦 Скачать оба трека в формате MP3 одним ZIP-архивом
- 🧠 Разделить дорожки нейросетевой моделью, понимающей микс, а не простым фильтром
- ⏱️ Принимает аудио- и видеофайлы длительностью до 10 минут
- 🗑️ Автоматически удаляет загрузки и результаты в течение 30 минут
Когда это пригодится
- 🎤 Репетиция песни: петь под минусовку или изучать выделенный голос
- 🎶 Устроить караоке-вечер дома, не ища готовые версии без вокала
- 🎧 Создавать ремиксы и мэшапы из чистых дорожек
- 🎙️ Убрать голос из саундтрека подкаста или видео
- 🎓 Музыкальное обучение: слушать голос и аккомпанемент раздельно
Ваш файл отправляется на наш VPS-сервер, где нейросеть Demucs выполняет разделение; и загрузка, и результаты автоматически удаляются в течение 30 минут. Каждый запуск стоит кредитов, а модель на CPU сервера работает примерно столько же, сколько длится воспроизведение трека. Один запуск ограничен 10 минутами аудио — более длинные треки можно предварительно нарезать инструментом обрезки. На чистых студийных миксах дорожки получаются практически без взаимных проникновений; сильно обработанные записи — плотный метал, тяжёлая реверберация, искажённый вокал — могут давать небольшие перекрёстные наводки. Это нормальное свойство любой модели разделения источников.
Похожие инструменты
Облачная аудиостудия
Конвертируйте, сжимайте, обрезайте, регулируйте громкость, удаляйте паузы, изменяйте скорость, добавляйте затухание, инвертируйте, создавайте петли и визуализируйте аудиофайлы.
Объединение аудио
Объедините от 2 до 6 аудиоклипов в один файл в выбранном вами порядке
Аудио в текст
Превращает речь из любого видео или аудио в обычный текст — на основе Qwen3-ASR