Разделите любую песню на вокальную и инструментальную дорожки в один клик с помощью модели demucs с открытым исходным кодом. Совершенно бесплатно, без водяных знаков и без загрузки на сторонние серверы.
Бесплатный AI-удалитель вокала и создатель караоке. Разделите любую песню на чистую вокальную дорожку и инструментальную (караоке) дорожку прямо в браузере. Построено на модели demucs с открытым исходным кодом от Meta (htdemucs_ft) — тот же ИИ, который используют звукорежиссёры при создании музыки. Без регистрации, без водяных знаков — аудио обрабатывается на наших серверах, дорожки приходят в одном ZIP-архиве.
Конфиденциальность: мы не храним и не передаём ваши аудиофайлы — они автоматически удаляются после обработки.
Примечание: обработка выполняется на нашем CPU-сервере, обычно каждая песня занимает 1-3 минуты.
Что такое отделение вокала?
Что такое отделение вокала?
Отделение вокала (также называемое удалением вокала или разделением дорожек) — это процесс разделения готовой песни на две части: vocals — пение, рэп или речь — и instrumental (всё остальное: ударные, бас, гитары, клавишные, синтезаторы). Это та самая технология, которая делает возможным караоке без живой группы, и позволяет продюсерам семплировать, ремикшировать или каверить песни, которые никогда не выпускались в виде отдельных дорожек.
До конца 2010-х годов для этого требовался либо доступ к оригинальным мультитрекам студии (редко), либо трюки с подавлением фазы, которые работали только на монофонических записях. Современные модели ИИ, такие как demucs, принимают полностью смикшированную песню как входные данные и создают две чистые дорожки, даже на треках с тяжёлой реверберацией, сайдчейн-компрессией или многослойным бэк-вокалом.
Перетащите файл в поле загрузки выше или нажмите, чтобы выбрать. Имя выбранного файла появится под полем.
Выберите формат вывода. Выберите MP3 для компактного файла, который можно воспроизвести на любом устройстве, или WAV для несжатого мастера, пригодного для дальнейшего редактирования в DAW.
Нажмите Разделить. Браузер загружает файл на наши серверы, где его обрабатывает модель ИИ (htdemucs_ft). Индикатор прогресса показывает шаг «Загрузка модели ИИ» при первом использовании инструмента, затем «Идёт разделение vocals и instrumental», пока песня анализируется. Песня длиной 3 минуты обычно занимает 60–180 секунд.
Скачайте ZIP. По завершении задания нажмите Скачать ZIP (vocals + instrumental), чтобы сохранить один архив, содержащий обе дорожки. Обе дорожки имеют тот же темп и высоту, что и исходный файл — они готовы к вставке в проект.
Советы для лучших результатов
Используйте источник максимально высокого качества. Форматы с потерями, такие как MP3 128 кбит/с, вносят артефакты, которые ИИ не может исправить. Источник MP3 320 кбит/с, AAC, FLAC или WAV всегда звучит заметно чище.
Короткие клипы разделяются быстрее и лучше. Если вам нужен только припев или куплет, сначала вырежьте нужный фрагмент в DAW; модель анализирует весь файл.
Моно тоже подойдёт. Большинство поп-, рок- и хип-хоп-релизов смикшированы в стерео, но ИИ одинаково хорошо обрабатывает моно-источники.
Тяжёлый мастеринг — ваш враг. Треки «войны громкости», обработанные brick-wall-лимитером, лишают модель пространственных ориентиров. Песня, профессионально смикшированная, но не мастерингованная, обычно разделяется намного лучше, чем та же песня после лимитирования до -8 LUFS.
Что на самом деле означает «instrumental» здесь
demucs htdemucs_ft — это гибридный трансформер, который разбивает песню на четыре внутренних источника: vocals, drums, bass и other (гитары, клавишные, синты и всё прочее). Режим «--two-stems vocals», который мы используем, возвращает две дорожки:
Vocals = предсказание вокала моделью.
Instrumental = исходная песня минус предсказание вокала. Это вычисляется путём вычитания вокала из входа, из-за чего instrumental звучит «пусто» в некоторых частотах — это нормально, и это тот же артефакт, который производит каждый AI-удалитель вокала.
Если вам нужны более детальные дорожки (только ударные, только бас и т.д.), полная модель demucs предоставляет их как отдельный вариант; режим двух дорожек — это то, что нужно большинству рабочих процессов караоке и ремиксов.
Типичные применения
Караоке-минусовки — загрузите instrumental в приложение караоке.
Извлечение акапеллы для мэшапов и ремиксов.
Семплирование — вытащите чистый вокальный или инструментальный луп из готовой записи.
Практика и обучение — пойте вместе с instrumental, затем сравните свой кавер с оригинальной акапеллой.
Реставрация аудио — изолируйте вокал для очистки, шумоподавления или коррекции высоты, не затрагивая аккомпанемент.
Технические замечания
Модель работает только на CPU на нашем сервере. Первый запрос после запуска нового контейнера тратит около 20–30 секунд на загрузку 340 МБ весов модели в память; последующие запросы начинают обработку немедленно. Аудио длиннее лимита обработки сервера (в настоящее время 50 МБ) будет отклонено — сначала разделите длинные файлы, если это необходимо.
Если вы ищете сепаратор вокала, создатель караоке, инструмент удаления вокала из песни, извлечение инструментала или инструмент отделения певца, этот инструмент создан именно для этого.
Часто задаваемые вопросы
Этот удалитель вокала бесплатный?
Да — никакой регистрации, никакой оплаты, никаких водяных знаков. Страница финансируется ненавязчивой рекламой, а расходы на сервер мы берём на себя.
Загружается или передаётся ли моё аудио?
Файл загружается на наш сервер на время выполнения задания разделения и немедленно удаляется. Мы не храним, не перекодируем, не передаём и не анализируем ваше аудио за пределами того, что необходимо для создания дорожек.
Какие аудиоформаты поддерживаются?
MP3, WAV, FLAC, OGG, M4A, AAC, OPUS, WMA, AIFF и M4B. Битовая глубина и частота дискретизации нормализуются автоматически.
Может ли он разделить отдельные инструменты, такие как ударные или бас?
Не в этом инструменте — базовая модель настроена для самого распространённого случая (vocals против всего остального). Полный четырёхдорожечный режим (vocals, drums, bass, other) доступен в вышестоящем проекте demucs.
Почему первый запрос занимает так много времени?
Первый запрос сепаратора вокала после запуска нового сервера тратит около 20–30 секунд на загрузку модели ИИ объёмом 340 МБ в память. Последующие запросы начинаются немедленно. Индикатор прогресса показывает «Загрузка модели ИИ» на этом этапе, чтобы вы знали, что процесс не завис.
Стоит ли выбирать MP3 или WAV для вывода?
MP3 намного меньше и подходит для караоке или повседневного прослушивания. WAV — несжатый формат, и это то, что вам нужно, если вы собираетесь редактировать дорожки в DAW, поскольку сжатие с потерями добавляет артефакты, которые сохраняются при дальнейшей обработке.
Сколько времени занимает разделение?
На нашем CPU-сервере песня длиной 3 минуты обычно занимает 60–180 секунд. Очень длинные файлы (более 10 минут) могут превысить лимит на задание; сначала разделите файл, если вам нужны более длинные сегменты.
Что, если из моей песни уже удалён вокал?
Если входные данные чисто инструментальные, дорожка «vocals» будет тихой (или почти тихим шипением), а дорожка «instrumental» будет идентична входу.