tomai
Войти
☁️ Облако · кредитов

Разделение вокала

Разделяйте любую песню на вокал и инструментал нейронной моделью — мгновенный караоке

🪙 Нейронное разделение дорожек на нашем сервере: 5 кредитов за задачу

🎙️ Нейронная модель разделяет аудио на вокал + инструментал (MP3). Поддерживаются видео до 10 минут.

Серверный FFmpeg обрабатывает любой формат — включая файлы HEVC/H.265, которые ваш браузер не воспроизводит. Файлы удаляются с сервера в течение 30 минут.

Дорожки для репетиций, ремиксов и караоке

Разделите любой трек на вокал и минус — или на четыре дорожки, включая барабаны и бас, — с доставкой в виде ZIP из отдельных файлов.

🎙️

AI-разделение вокала

Модель глубокого обучения (Demucs) разделяет трек на голос и музыку, анализируя микс целиком, — а не простым фильтрованием частот.

🎤

Вокал + минусовка

Из одной загрузки получаете минусовку для караоке и чистую акапеллу — ремикшируйте, делайте каверы или разбирайте любую из дорожек.

📦

ZIP с обеими дорожками

Обе разделённые дорожки скачиваются одним ZIP-архивом — готовы к импорту в вашу DAW или видеоредактор.

Частые вопросы

Насколько хорошее разделение?

Demucs — самая сильная открытая модель разделения дорожек. На чистых студийных миксах вокал выходит практически без инструментов. В крайних случаях — сильная реверберация, искажённый вокал, плотные метал-миксы — между дорожками появляется небольшое смешивание, что нормально для любой модели разделения источников.

Почему ZIP, а не два отдельных скачивания?

Обе дорожки создаются вместе на нашем сервере, а ZIP сохраняет их в паре и сохраняет имена файлов. В архиве ровно vocals.mp3 и instrumental.mp3.

Какое ограничение по длительности?

10 минут на задачу — нейронное разделение дорожек требовательно к CPU, более длинные входы исчерпали бы мощность сервера. Более длинные песни можно сначала обрезать инструментом обрезки видео и разделить по частям.

Почему в минусе всё ещё едва слышен вокал?

Разделение статистично, а не идеально — частоты, пересекающиеся между голосом и инструментами, оставляют остаточный сигнал. Модель на 4 дорожки снижает его сильнее, чем модель на 2; для полностью чистого минуса выбирайте треки с редким вокалом по центру стереопанорамы.

Модели разделения источников и результаты

Для разделения используется нейросеть, оптимизированная по SDR и выполняемая на CPU воркера:

Каждая дорожка кодируется на исходной частоте дискретизации в MP3 320 kbps (или WAV, если источник был без потерь) и упаковывается в один ZIP. Принимаются песни длительностью до 15 минут. Просачивание между дорожками минимально на хорошо сведённых записях поп/рок и выше на плотных электронных миксах — страница предупреждает об этом заранее, потому что честные ожидания лучше неожиданных возвратов средств.

Как это работает

  1. 1

    Загрузите песню или видео — до 10 минут, любой аудиоформат или большинство видео.

  2. 2

    Запустите задачу. Нейронная модель анализирует микс и отделяет голос от инструментовки.

  3. 3

    Скачайте ZIP-архив с vocals.mp3 и instrumental.mp3. Обработка на CPU занимает примерно столько же времени, сколько длится сама песня.

Похожие инструменты

Что такое разделение вокала?

Разделитель вокала разбирает песню на два чистых трека: только голос и только музыку. Вместо грубой фильтрации, оставляющей следы второй половины, нейросетевая модель разделения источников прослушивает весь микс и восстанавливает вокал и инструменты как отдельные аудиопотоки. Загрузите аудиофайл — или видео со звуком — длительностью до 10 минут, и наш сервер вернёт ZIP-архив с vocals.mp3 и instrumental.mp3. Певцы репетируют без мелодии, ремиксеры изолируют припев или бит, редакторы подкастов убирают лишние голоса из фрагмента, а любители караоке за секунды получают минусовку. Само разделение выполняется на нашем сервере с помощью модели Demucs с открытым исходным кодом.

Что умеет этот инструмент

  • 🎤 Выделить голос из любой песни в чистый акапелла-трек
  • 🎹 Извлечь инструментал — готовую караоке-версию за секунды
  • 📦 Скачать оба трека в формате MP3 одним ZIP-архивом
  • 🧠 Разделить дорожки нейросетевой моделью, понимающей микс, а не простым фильтром
  • ⏱️ Принимает аудио- и видеофайлы длительностью до 10 минут
  • 🗑️ Автоматически удаляет загрузки и результаты в течение 30 минут

Когда это пригодится

  • 🎤 Репетиция песни: петь под минусовку или изучать выделенный голос
  • 🎶 Устроить караоке-вечер дома, не ища готовые версии без вокала
  • 🎧 Создавать ремиксы и мэшапы из чистых дорожек
  • 🎙️ Убрать голос из саундтрека подкаста или видео
  • 🎓 Музыкальное обучение: слушать голос и аккомпанемент раздельно

Ваш файл отправляется на наш VPS-сервер, где нейросеть Demucs выполняет разделение; и загрузка, и результаты автоматически удаляются в течение 30 минут. Каждый запуск стоит кредитов, а модель на CPU сервера работает примерно столько же, сколько длится воспроизведение трека. Один запуск ограничен 10 минутами аудио — более длинные треки можно предварительно нарезать инструментом обрезки. На чистых студийных миксах дорожки получаются практически без взаимных проникновений; сильно обработанные записи — плотный метал, тяжёлая реверберация, искажённый вокал — могут давать небольшие перекрёстные наводки. Это нормальное свойство любой модели разделения источников.

Похожие инструменты