Убирает фоновый шум из записи речи в аудио или видео, не теряя тихие слова, и выравнивает громкость голоса. Цена — 3 ₽ за минуту записи.
VEED Clean Audio — нейросеть, которая убирает шум из записи речи: улицу, кафе, ветер, гул кондиционера. Заодно выравнивает громкость голоса. Подходит, чтобы улучшить запись голоса из интервью, голосового или ролика: файл можно загрузить как аудио, так и видео.
Подкаст дома: мягкая очистка
Сила очистки 0,6 и громкость «Не менять»: гул ушёл, уровень записи как в исходнике.
Планёрка в шумном офисе
Клавиатуры, принтер и вентиляция за голосом, FLAC, громкость «Для подкастов».
Тихий голос на фоне офиса
Голос тише фона: после очистки слышно каждое слово, громкость подтянута до стандартной.
Лекция под гул кондиционера
Ровный гул вентиляции в аудитории убран, результат во FLAC, громкость стандартная.
Звук из видео на ветреной набережной
Режим «Видео»: из MP4 с порывами ветра получен чистый голос в WAV.
Голосовое из шумного кафе
Разговоры и посуда на фоне, громкость «Для подкастов», WAV: кафе пропало, голос остался.
Голосовое на ходу по шумной улице
Уличный шум громче голоса, WAV, громкость «Для соцсетей»: речь разборчива целиком.
Интервью у рынка без шума улицы
Машины и толпа за голосом, громкость стандартная, WAV: паузы чистые, слова все на месте.
Чужие голоса мы не брали. Короткие фразы выдуманных людей озвучили в ElevenLabs v4, шум улицы, кафе, ветра и офиса сгенерировали в «Звуковых эффектах» и наложили на голос. В начале каждой записи полторы секунды звучит один шум, поэтому по паузе легко понять, сколько его осталось. Результаты мы прогнали через распознавание речи и замерили громкость.
Мужчина наговаривает голосовое на ходу, мимо едут машины, шум на два децибела громче голоса. Настройки: Громкость «Для соцсетей», формат WAV.
VEED Clean Audio · исходник: голосовое на улице · 3 ₽/мин.
VEED Clean Audio · после очистки · 3 ₽/мин.
Это самая трудная из наших проб: если бы модель путала голос с шумом, здесь она срезала бы начала слов или оставила гул машин под фразами. В паузе шум упал с −23 до −66 дБ, то есть его практически не слышно. Распознавание разобрало каждое слово, включая «распечатку сметы» и «в 11». Готово было за полминуты.
Девушка звонит из кафе: за спиной гул голосов, звон посуды и кофемашина. С чужой речью на фоне очистке труднее, чем с машинами: модели нужно понять, какой голос главный.
VEED Clean Audio · исходник: кафе · 3 ₽/мин.
VEED Clean Audio · после очистки, громкость «Для подкастов» · 3 ₽/мин.
Кафе ушло вместе с соседями: в паузе шум упал с −28 до −73 дБ. Голос девушки распознался целиком.
Блогер снял ролик на набережной, ветер дует прямо в микрофон телефона. Мы загрузили MP4 с типом «Видео». В ответ пришла очищенная звуковая дорожка, без картинки.
VEED Clean Audio · звук исходного ролика · 3 ₽/мин.
VEED Clean Audio · после очистки, тип «Видео» · 3 ₽/мин.
Порывы ветра были самым громким шумом из всех проб, в паузе −16 дБ. После очистки там −61 дБ, а слова «сумасшедший» и «кофе с собой» на месте.
Женщина говорит тише обычного, а за ней стучат клавиатуры и гудит вентиляция. Здесь видна вторая половина работы модели: после очистки она поднимает громкость голоса.
VEED Clean Audio · исходник: тихий голос и офис · 3 ₽/мин.
VEED Clean Audio · после очистки, громкость стандартная · 3 ₽/мин.
Громкость выросла почти на 6 LUFS, до привычного уровня, а офис ушёл. Слова распознались слово в слово, вплоть до «минут 20».
Ведущая подкаста записывается в гостиной, с лёгким эхом и тихим гулом кондиционера. Здесь мы включили Дополнительно, поставили Силу очистки 0,6 и громкость «Не менять».
VEED Clean Audio · исходник: подкаст в комнате · 3 ₽/мин.
VEED Clean Audio · после, сила 0,6, громкость «Не менять» · 3 ₽/мин.
Уровень записи остался прежним, разница меньше одного LUFS: так удобно, если громкость вы потом выставите в монтаже сами. Гул в паузах всё равно пропал, с −35 до −77 дБ: по подсказке формы сила очистки меняет только фон под словами.
Выберите Тип генерации: «Аудио» для записи или «Видео» для ролика. Загрузите файл. Запись можно сделать прямо на странице, микрофоном. Задание писать не нужно. Сайт сам определит длину файла, и цена появится на кнопке Отправить ещё до запуска.
Модель отделяет речь от всего остального. В паузах между словами она убирает шум полностью, а под голосом оставляет немного фона, чтобы тихие и дальние слова не обрезались. Потом выравнивает громкость, как это делают для видео и подкастов. По словам разработчиков, эта же очистка стоит за кнопкой Clean Audio в их видеоредакторе, а десятиминутный файл обрабатывается 2–5 минут. Наши записи по 13–18 секунд были готовы за 17–33 секунды.
Результат появится в ленте под формой и пролежит 7 дней в Моих результатах. Скачайте его кнопкой Скачать или сохраните в библиотеку. Изменить вернёт файл и настройки в форму, если захотите другую громкость. Повторить сразу запустит ту же очистку ещё раз.
| Поле | Что меняет | Что ставить |
|---|---|---|
| Громкость | Итоговый уровень голоса. LUFS — единица воспринимаемой громкости: чем ближе к нулю, тем громче | «Стандартная» для видео и звонков; «Не менять», если громкость потом выставите в монтаже |
| Формат результата | WAV или FLAC, оба без потери качества | WAV, если не знаете, что выбрать: он открывается везде. FLAC весит примерно вдвое меньше |
| Сила очистки | Сколько фона остаётся под словами, от 0 до 1. Появляется, если включить «Дополнительно» | Без изменений. Если голос звучит слишком «сухо», уменьшите до 0,6–0,7 |
Режимы громкости «Для подкастов» и «Для соцсетей» в наших пробах сработали почти как стандартный: вместо −16 и −14 вышло от −18,5 до −20,3 LUFS. Похоже, модель не даёт самым резким звукам подойти к пределу, за которым они хрипят, и поэтому дальше громкость не поднимает. На записях с мягкими пиками может выйти иначе, но мы бы на −14 не рассчитывали. Если нужен громкий звук для соцсетей, добавьте громкости в монтаже.
Платите за каждую начатую минуту записи. Тип файла, громкость, формат и сила на цену не влияют.
| Длина записи | Цена |
|---|---|
| до минуты: голосовое или короткий ролик | 3 ₽ |
| 5 минут: кусок интервью | 15 ₽ |
| 10 минут | 30 ₽ |
| 30 минут, больше одна запись не примет | 90 ₽ |
Перед длинной записью проверьте модель на отрывке до минуты с самым шумным местом: так станет ясно, подходит ли она вашему шуму.
Две пробы прошли хуже. Лекцию с гулом и сильным эхом пустого зала модель очистила, но распознавание после неё услышало «скросские предложения» вместо «спрос и предложение». Голос, который был на 10 дБ тише фона, вышел чистым, но «говорю слишком тихо» превратилось в «гадаю слишком тияно». В шумных исходниках обе фразы распознавались верно. Сила очистки 0,6 в наших пробах не помогла: ошибки повторились слово в слово.
VEED Clean Audio · исходник: лекция с эхом · 3 ₽/мин.
VEED Clean Audio · после очистки: послушайте «спрос и предложение» · 3 ₽/мин.
Та же лекция без эха, только с гулом кондиционера, очистилась без ошибок. Судя по этим пробам, в гулкой комнате лучше переписать звук ближе к микрофону, а если это невозможно — сравните результат с исходником в спорных местах.
| Нейросеть | Цена | Что на входе | Что делает | Когда брать |
|---|---|---|---|---|
| VEED Clean Audio | 3 ₽/мин. | аудио или видео до 30 минут | убирает шум и выравнивает громкость, отдаёт WAV или FLAC | запись нужна сразу готовой к публикации |
| ElevenLabs Audio Isolation | 0.4 ₽/сек. | аудио или видео до часа | вырезает всё, кроме голоса | запись дольше 30 минут |
| DeepFilterNet3 | 0.2 ₽/сек. | только аудио до 10 минут | приглушает ровный шум, отдаёт файл в одном из 7 форматов | нужен сразу MP3 или OPUS |
Как две другие нейросети справились с одними и теми же записями, мы показали в статье «Улучшение аудио». Пошаговый разбор чистки старых записей — в инструкции о фоновом шуме.
Описание обновлено 2 октября 2026 г.