Преобразование одной звуковой дорожки в другую: смена голоса, перенос тембра на готовую запись, разделение трека на вокал и инструменты, чистка шума и эха, ремикс и мастеринг. Текст здесь не участвует вовсе — на входе и на выходе звук, поэтому раздел не пересекается ни с озвучкой написанного, ни с генерацией музыки по описанию. Задачи бывают бытовые, вроде спасения диктофонной записи, и студийные, когда нужно вытащить минус или заменить вокал. В каталоге — 52 нейросети. Есть 4 с бесплатным тарифом.

Нейросеть для анализа данных и создания отчетов.


инструмент на основе ии, который воспроизводит чей-то голос и генерирует бесконечный аудиоконтент, имеющий потенциальное применение в здравоохранении, колл-центрах и за его пределами.

инструмент, который позволяет легко манипулировать записями вокала с помощью технологии ии с помощью таких функций, как улучшение голоса, синтез, модуляция и обширный каталог голосов из разных регионов.

комплексный инструмент для создания музыки, который предлагает ряд функций, включая удаление вокала, создание стеблей, изучение песен, ремиксы и восстановление звука.

универсальная нейросеть, которая предлагает такие функции, как редактирование нот, обнаружение аккордов, разделение стеблей, преобразование аудио в MIDI, генерацию подписи журнала и генерацию сэмплов текста в аудио.


веб-сайт для поиска и создания случайных музыкальных образцов.

нейросеть, которая позволяет бесплатно мастерить песни до 7 раз в неделю, применяя сжатие и лимитирование, при этом необходимо правильно микшировать трек и эталонный трек с похожей атмосферой.

Механизм преобразования речи в речь Resemble AI генерирует естественно звучащую речь в различных приложениях и предлагает API для простой интеграции в приложения для голосового общения с малой задержкой.

Splitter.ai: обработка звука на базе искусственного интеллекта для разделения вокала, ударных, фортепиано и многого другого для высококачественного извлечения звука.


Нейросеть для извлечения звуковых эффектов из видео.


Нейросеть для создания и редактирования вокальных партий.

Этот нейросеть отделяет вокал от музыкальных треков с помощью алгоритмов машинного обучения и предлагает версии песен для инструментов или акапеллы.
NeuroFolder ведёт каталог нейросетей с 2023 года. Позиции учитывают оценку каталога, отзывы пользователей и популярность сервиса. Список регулярно обновляется.
Современные модели дают чистое разделение на большинстве записей, но на плотном миксе остаются призвуки. Для точной работы берите сервис, который отдаёт отдельные дорожки в несжатом формате.
Тембр повторяется убедительно уже с нескольких минут материала, а вот интонации и манера речи копируются хуже. Чем эмоциональнее оригинал, тем заметнее разница.
Шумоподавление и восстановление разборчивости помогают, если речь в принципе слышна. Полностью заглушенные или обрезанные по частотам фрагменты восстановить нельзя — модель их просто додумает.
Голос охраняется как часть личных прав, и для публикации нужно согласие человека. Для внутренних экспериментов риск ниже, но публикация и коммерческое использование без разрешения ведут к претензиям.