Преобразование одной звуковой дорожки в другую: смена голоса, перенос тембра на готовую запись, разделение трека на вокал и инструменты, чистка шума и эха, ремикс и мастеринг. Текст здесь не участвует вовсе — на входе и на выходе звук, поэтому раздел не пересекается ни с озвучкой написанного, ни с генерацией музыки по описанию. Задачи бывают бытовые, вроде спасения диктофонной записи, и студийные, когда нужно вытащить минус или заменить вокал. В каталоге — 52 нейросети. Есть 4 с бесплатным тарифом.

нейросеть, которая удаляет барабаны из песен, позволяя пользователям создавать треки без барабанов и изолировать элементы ударных для более универсального музыкального восприятия.


Нейросеть для изменения голоса, подходит для видео и звонков.


генератор обложек песен с искусственным интеллектом, который использует технологию клонирования голоса, чтобы превращать любимые песни в персонализированные шедевры.


Платформа для работы с голосом: синтез речи на 30+ языках, клонирование голоса по 15-секундной записи, распознавание речи и разделение аудиодорожек.

нейросеть, которая легко извлекает из песен вокал, бас, ударные, гитару и фортепиано с высококачественными результатами.

Программа для изменения голоса в реальном времени: 500+ фильтров, 100 тысяч звуковых эффектов, работа в Discord, Zoom и играх. Есть бесплатный режим на 5 голосов в день.

инструмент-генератор музыки с искусственным интеллектом и моделями голоса на уровне исполнителя, позволяющий легко создавать кавер-версии; имеет вокальную изоляцию, музыкальную композицию и универсальные входные форматы.

Instant Singer позволяет легко клонировать и заменять голос.


нейросеть, которая исследует вашу музыкальную библиотеку на предмет скрытых драгоценных камней, сэмплов и петель.

AI-инструмент Vocal Remover от Kingshiper легко извлекает вокал или инструментальные партии из аудио/видео дорожек с помощью пакетной обработки и экспорта в один клик.


инструмент на базе ии, который улучшает онлайн-встречи, удаляя шум и эхо, обеспечивая четкость голоса, автоматическую транскрипцию и полную интеграцию с различным программным обеспечением.


инструмент для разделения стеблей, удаления вокала и очистки голоса на базе ии, который извлекает вокал и инструменты из аудио- и видеофайлов, удаляет нежелательный шум и артефакты и интегрируется с другими сервисами через свой API.
NeuroFolder ведёт каталог нейросетей с 2023 года. Позиции учитывают оценку каталога, отзывы пользователей и популярность сервиса. Список регулярно обновляется.
Современные модели дают чистое разделение на большинстве записей, но на плотном миксе остаются призвуки. Для точной работы берите сервис, который отдаёт отдельные дорожки в несжатом формате.
Тембр повторяется убедительно уже с нескольких минут материала, а вот интонации и манера речи копируются хуже. Чем эмоциональнее оригинал, тем заметнее разница.
Шумоподавление и восстановление разборчивости помогают, если речь в принципе слышна. Полностью заглушенные или обрезанные по частотам фрагменты восстановить нельзя — модель их просто додумает.
Голос охраняется как часть личных прав, и для публикации нужно согласие человека. Для внутренних экспериментов риск ниже, но публикация и коммерческое использование без разрешения ведут к претензиям.