Интервью на телефон
Хрестоматийный случай: двое в кафе, телефон между ними. Фильтр убирает чашки и кофемашину, оба голоса остаются, вместе с расстоянием. Одного прогона обычно хватает.
Голосовая заметка, надиктованная на шумной террасе, прогнанная через оба шумодава каталога бок о бок, DeepFilterNet 3 и ElevenLabs Audio Isolation. Весь процесс виден без регистрации.
Настоящий воркфлоу, реальные результаты. Двигайте холст и приближайте как угодно.
Использовать этот воркфлоуРеальный процесс: одна и та же шумная заметка входит в два узла «Улучшить звук», и вы слышите, что убрал каждый.
Коротко
Интервью, записанное на телефон в кафе, голосовая заметка на улице, голос подкаста с холодильником позади: фоновый шум и есть то, что отделяет пригодную запись от той, которую придётся переписывать. Этот процесс убирает его двумя моделями каталога, которые это умеют, и ставит их бок о бок, потому что работают они по-разному.
DeepFilterNet 3 это фильтр: он убирает то, что не голос, и оставляет воздух комнаты, результат остаётся естественным. ElevenLabs Audio Isolation строит голос заново: суше, радийнее, на согласных иногда чуть синтетично. На заметке из демо, специально собранной из чистого голоса, уличного фона и гула, мы точно знаем, что нужно было убрать.
Ваш файл входит через кнопку импорта узла, до десяти минут за прогон, а цена считается посекундно: две чистки на четырнадцати секундах стоят 7 центов, а DeepFilterNet сам по себе выходит в девять кредитов в минуту.
Загрузите запись
MP3, WAV, M4A или OGG, до десяти минут. Узел читает длительность и показывает цену до любого нажатия. Звук, созданный в другом месте холста, тоже подключается к порту.
Запустите фильтр
Сначала DeepFilterNet 3: он самый дешёвый и самый верный. Если голос вышел чистым, а комната ещё на месте, вы закончили.
Попробуйте реконструкцию
Если шум был сильным или голос должен лечь на музыку, запустите изоляцию рядом. Она выходит суше, а это лучше смешивается в монтаже.
Слушайте согласные
Именно там два расходятся: звуки «с» и «т» первыми страдают от шумодава. Победивший файл уходит в монтаж или скачивается из узла.
Тот же холст, настроенный под разные задачи: в каждом варианте меняются две-три строки промпта.
Хрестоматийный случай: двое в кафе, телефон между ними. Фильтр убирает чашки и кофемашину, оба голоса остаются, вместе с расстоянием. Одного прогона обычно хватает.
Холодильник, улица за окном, вентилятор компьютера: ровный тихий шум, который фильтр убирает без следа. Для голоса близко к микрофону нужен DeepFilterNet, реконструкция была бы лишней.
Заметка из демо. Громкий переменчивый шум, машины и прохожие. Фильтр оставляет подложку, реконструкция её стирает: здесь побеждает она, потому что нужно понять, а не сохранить атмосферу.
Закадровый текст, записанный без студии, чтобы лечь на картинку и музыку. Результат изоляции, более сухой, лучше смешивается в Монтаже, чем голос, который всё ещё тащит за собой комнату.
Оцифрованная кассета с её шипением и гулом. Фильтр убирает шипение и сохраняет голос таким, каким он был, а от воспоминания нужно именно это: чёткий, не переписанный.
Далёкий голос, реверберация, кашель. Оба убирают шум; ни один не укорачивает реверберацию зала, которая не шум, а пространство. Ждите чёткий, но по-прежнему далёкий голос.
Цена считается посекундно. Чистить час записи, чтобы оставить десять минут, значит переплатить вшестеро. Сначала режьте, потом чистите тот фрагмент, который оставляете.
Фильтр, а потом реконструкция, или наоборот, не даёт вдвое лучшей чистки: вторая модель работает с уже изменённым голосом и усиливает его артефакты. Один прогон, выбранный на слух.
Шумодав убирает то, что не голос; он не приближает микрофон, стоявший в трёх метрах. Реверберация и расстояние остаются. Вы услышите тот же голос без шума вокруг.
Запись концерта после шумодава выходит с голосом и без группы: инструменты считаются шумом. Для песни нужно разделение на дорожки, а не чистка.
Почти всегда сначала фильтр: он убирает шум, не переписывая голос. Реконструкцию, когда шум был громче голоса или когда результат должен раствориться в музыке, потому что более сухой тембр смешивается лучше.
Нет, и это намеренно. Обе модели оставляют голос и выбрасывают остальное: в песне музыка считается шумом. Чтобы разделить песню на дорожки, процесс отделить вокал от песни делает это с Demucs.
Оба голоса сохраняются, ни одна из моделей не различает говорящих. Уходит шум между ними, а не один из них. Чтобы оставить один голос, нужно описать искомое SAM Audio, другому узлу каталога.
DeepFilterNet 3 выходит в девять кредитов в минуту, изоляция ElevenLabs в четырнадцать. Заметка из демо, четырнадцать секунд в двух узлах, стоит шесть кредитов. Цена показана на узле до нажатия, на измеренной длительности вашего файла.
Десять минут за прогон. Более длинная запись режется на части в монтаже или чистится только на тех фрагментах, которые вы оставляете, что в любом случае дешевле.
Фильтр нет: он убирает, ничего не добавляя. Реконструкция немного: она переписывает голос по тому, что распознала, и на шипящих это бывает слышно. Поэтому демо показывает обе.
Да, в два шага: Монтаж экспортирует звуковую дорожку, узел её чистит, и чистый голос возвращается на картинку вместо старого.
Нет. Загруженное остаётся в вашем рабочем пространстве и не передаётся ни на какое обучение, и здесь этот вопрос весит больше, чем где-либо: речь часто об интервью и голосах близких.
Почистить запись с помощью ИИ
Использовать этот воркфлоуБесплатный аккаунт, без банковской карты. Воркфлоу откроется уже заполненным на вашем холсте.