Шумоподавление (Resemble Enhance) — убирает фоновый шум, артефакты и улучшает чёткость речи и музыки с помощью диффузионной модели.
Входной файл
Параметры
0.5
0 = без шумоподавления, 1 = максимальное
0.5
Баланс между оригиналом и обработанным звуком
64
Больше шагов = выше качество, но дольше
Алгоритм интегрирования диффузионной модели
Улучшение (Enhance)
Дополнительная обработка после шумоподавления — улучшает чёткость звука
...
Match EQ (Matchering) — подстраивает тембр, громкость и динамику одного файла под другой. Полезно для сведения и мастеринга.
Файлы
Этот файл будет подстроен под референс
EQ и громкость target будут подстроены под этот файл
Параметры
Результат всегда сохраняется в WAV (без потерь)
Лимитер
Предотвращает цифровое клиппирование на выходе
...
RVC (Retrieval-based Voice Conversion) — клонирование и конвертация голоса. Обучите модель на своих записях, затем переносите голос на любое аудио.
Обучение
Конвертация
Датасет
Загрузите аудиокнигу или запись голоса. Рекомендуется от 10 минут чистой речи.
Латинские буквы и цифры, без пробелов
Параметры обучения
Должна совпадать с частотой датасета
Алгоритм извлечения основного тона
500
500 обычно достаточно для 2+ часов голоса
8
P100 16GB: можно до 16
50
Нейросеть синтеза звука
...
Разделение голосов (pyannote) — автоматически определяет кто говорит в аудиофайле и нарезает его по собеседникам.
Входной файл
Параметры
1
10
Оставьте пустым чтобы экспортировать всех
...
Разделение треков (Demucs) — разделяет аудио на отдельные инструментальные дорожки: вокал, барабаны, бас, другое. Модель htdemucs_6s также выделяет гитару и фортепьяно.
Входной файл
Параметры
htdemucs_ft даёт лучшее качество, но работает дольше
0
0 = быстро, 5–10 = лучше качество
0.25
Больше = меньше артефактов на стыках
...
Генерация звука (Stable Audio) — создаёт музыку и звуковые эффекты по текстовому описанию. Поддерживает негативный промпт и несколько вариантов за один запуск. Стерео, до 47 секунд.
Промпт
Понимает звуковые эффекты, ambient, музыку. Описывайте на английском.
Что исключить из результата
Параметры
15
Максимум 47 секунд
100
Больше шагов = лучше качество
1
Несколько вариантов на выбор
-1 = случайный
...
Дереверберация (NARA-WPE) — убирает эффект эха и реверберации помещения из аудио. Полезно для записей в комнате с отражениями.
Входной файл
Параметры
5
Больше = лучше, но дольше
3
Задержка фильтра в фреймах
10
Больше = захватывает более длинное эхо
...
VoiceFixer — восстанавливает качество речи: убирает шум, артефакты компрессии, восстанавливает высокие частоты. Эффективен для сильно деградированных записей.
Входной файл
Параметры
Режим 0 подходит для большинства случаев
...
ClearerVoice-Studio — speech enhancement, separation and super-resolution via MossFormer2 / FRCRN models.
Входной файл
Параметры
...
MILFER — speech-preserving audio restoration. Extracts SSL speech features and reconstructs a clean 48kHz waveform. Handles noise, reverb, band-limiting, saturation.
Входной файл
Параметры
...
Нормализация — компрессор → гейт → loudnorm двухпроходный → verify-and-correct. Автоматически рассчитывает параметры компрессора и гейта для попадания в заданные target values.
Входной файл
Пресет
Target values
Компрессор
Выходной формат
...
De-esser — подавление сибилянтов (с, ш, щ, з). Анализирует спектр 4–12 kHz и рекомендует параметры автоматически.
Входной файл
De-popper — подавление взрывных согласных (п, б, т, д, к). Анализирует транзиенты в диапазоне 20–250 Hz и рекомендует параметры.
Входной файл
Фонемный процессор — обнаруживает сибилянты и взрывные, обрабатывает параллельным де-эссером / де-поппером.
Входной файл
...
Эквализация
Эквализация — ручная частотная коррекция.
Входной файл
Эквалайзер
0.0
60
0.0
120
0.0
250
0.0
500
0.0
1k
0.0
2k
0.0
3.5k
0.0
5k
0.0
8k
0.0
10k
0.0
12k
Системный монитор — состояние GPU, CPU, RAM, дисков, сервисов и очереди задач. Обновляется каждые 5 секунд.
GPU
Загрузка...
CPU & RAM
Загрузка CPU
0%
Использование RAM
0%
Диски
Сервисы
Очередь и хранилище
Задач в очереди
—
Файлов результатов
—
Перезапуск сервисов