Перейти к основному контенту

ACE-Step: нейросеть для музыки на своём компьютере без подписки

ACE-Step 1.5 генерирует песни с вокалом локально: лицензия MIT, от 6 ГБ видеопамяти, Mac и Windows, русский текст, установка и права.

Лицензия
MITбез лимитов и подписки
Видеопамять
от 6 ГБбазовая 1.5; XL — от 12 ГБ
Дообучение
8 песен, 1 часна RTX 3090

Короткий ответ

ACE-Step — открытая модель генерации песен с вокалом, которая работает на вашем компьютере: без подписки, лимитов, карты и VPN. Версия 1.5 на 2 млрд параметров запускается на видеокарте с 6 ГБ памяти, на Mac с Apple Silicon и на картах AMD и Intel; старшая 1.5 XL на 4 млрд требует от 12 ГБ. Лицензия MIT — результат ваш без ограничений со стороны разработчика. Модель принимает текст на 50+ языках, включая русский, умеет кавер, дописывание, точечную перегенерацию фрагмента и аккомпанемент под ваш вокал, а на 8 своих песнях обучается под ваш стиль за час. Плата за свободу — качество: русский вокал ложится на музыку хуже, чем в Suno, и результат чаще требует доработки. Для релиза действуют те же правила маркировки ИИ.

Все облачные генераторы объединяет одно: они принадлежат не вам. Лимиты меняются, скачивание отключают, сервис продают и закрывают. ACE-Step — ответ на это: модель уровня Suno годичной давности, которая живёт на вашем диске. Ниже — что она умеет, на чём запускается, как ставится и где честно уступает облаку.

Что такое ACE-Step

ACE-Step — открытая модель генерации песен, разработанная командами ACE Studio (синтез вокала) и StepFun (большие модели). Первая версия вышла в 2025 году, версия 1.5 — в начале 2026-го, старшая 1.5 XL — 2 апреля 2026 года.

Ключевые свойства:

  • Лицензия MIT. Можно использовать, изменять и встраивать куда угодно, включая коммерческие продукты. Разработчик не претендует на результат.
  • Локальный запуск. Модель работает на вашем компьютере. Никаких кредитов, лимитов на скачивание, проверки региона и карты.
  • Песни с вокалом от 10 секунд до 10 минут, текст на 50+ языках.
  • Скорость. На RTX 3090 полный трек генерируется меньше чем за 10 секунд.
  • Дообучение. На 8 своих песнях модель обучается под ваш стиль примерно за час на карте с 12 ГБ памяти.

Какой компьютер нужен

МодельПараметрыМинимум видеопамятиКомфортноПлатформы
1.5 turbo / sft2 млрд6 ГБ8–16 ГБNVIDIA, AMD, Intel, Mac Apple Silicon
1.5 XL4 млрд12 ГБ с выгрузкой и квантованием20 ГБте же

Базовая модель — реалистичный вариант для домашнего компьютера: подходит игровая карта пятилетней давности или MacBook на чипе M-серии. XL заметно лучше по звуку, но требует карты уровня RTX 3090/4090 или аренды сервера.

Если своей видеокарты нет, модель запускают на арендованном GPU — час стоит дешевле подписки, а результат скачивается к себе.

Как установить ACE-Step

Способов несколько, от простого к сложному:

  1. Портативная сборка для Windows и macOS — архив с готовым окружением. Распаковать, запустить, открыть веб-интерфейс в браузере. Программировать не нужно.
  2. Ноды для ComfyUI — если вы уже пользуетесь им для картинок.
  3. Docker — для тех, кто держит модели в контейнерах.
  4. Python-пакет через pip или uv — для встраивания в свой процесс.
  5. VST3-плагин — генерация прямо в DAW, без переключения окон.

Первый запуск скачивает веса модели, это несколько гигабайт. Дальше — офлайн.

Начните с портативной сборки и базовой модели

Установка через Python — типичное место, где люди сдаются из-за конфликта версий. Портативная сборка обходит эту проблему. Модель XL пробуйте, только когда базовая уже работает и понятно, чего ей не хватает.

Как пользоваться: интерфейс и промты

Логика та же, что в облачных сервисах: поле для текста песни и поле для описания стиля тегами. Плюс возможности, которых в облаке либо нет, либо они платные.

Текст. Разметка секциями в квадратных скобках. Перед куплетом на русском ставится тег языка — без него модель может спеть кириллицу с английской фонетикой.

Стиль. Ключевые слова через запятую: жанр, темп, инструменты, характер вокала, эпоха. Работает лучше, чем развёрнутые предложения.

Vocal2BGM. Загружаете свой записанный вокал — модель строит под него аккомпанемент. Это прямой способ получить аранжировку под свою мелодию: нейросеть для аранжировки.

Cover. Свой трек в другом стиле с сохранением мелодии.

Repaint. Перегенерация выбранного фрагмента без пересборки всего трека — то, за что в облаке платят отдельно.

Extend. Дописать интро, финал или продлить середину.

Разделение на дорожки. Встроенная сепарация вокала и инструментала.

LoRA. Дообучение на своих треках: восемь песен, около часа на RTX 3090 — и модель генерирует в вашей манере. Для артиста с наработанным звучанием это единственный способ получить генерации, похожие на себя, не имитируя никого другого.

Русский вокал: честно

Русский в списке 50+ языков, и петь на нём модель будет. Проблема в другом: пользователи фиксируют, что русские слова растягиваются на несколько долей и плохо ложатся в ритм — заметно хуже, чем в английском и китайском. В обсуждениях проекта это открытый вопрос на 2026 год.

Что помогает:

  • явный тег языка перед каждой секцией;
  • короткие строки с равным числом слогов;
  • меньше согласных подряд на стыках слов;
  • перегенерация только проблемной секции через Repaint, а не всего трека.

Если русский вокал — главное в треке, облачные Mureka и Suno пока точнее. ACE-Step выигрывает там, где вокала нет, где он ваш собственный (Vocal2BGM), или где нужны десятки итераций без лимита.

ACE-Step отдаёт вам не подписку на нейросеть, а саму нейросеть. Это меняет экономику: сотня неудачных генераций стоит ноль.

Где ACE-Step лучше облака

  • Черновики без счётчика. Перебрать 50 вариантов аранжировки под свой текст за вечер — нормально.
  • Конфиденциальность. Неизданный материал не уходит на чужой сервер. Для артиста с лейблом это может быть требованием договора.
  • Свой стиль через LoRA. Облачные Persona и референсы — бледная версия этого.
  • Аккомпанемент под живой вокал. Vocal2BGM бесплатно делает то, за что в облаке нужен платный тариф.
  • Независимость. Отключение скачивания в Udio и закрытие Riffusion — не абстрактный риск: что случилось с Riffusion.

Где уступает

  • Качество вокала, особенно на русском.
  • Порог входа. Установка, видеокарта, английский интерфейс.
  • Стабильность стиля на длинных треках.
  • Нет «умного» помощника по тексту — текст пишете сами: текст песни нейросетью.

Права и релиз

Здесь ACE-Step проще облачных сервисов и одновременно сложнее.

Проще — потому что нет условий сервиса: лицензия MIT не ограничивает коммерческое использование, платный тариф для прав не нужен.

Сложнее — потому что нет и «разрешения от сервиса», на которое ссылаются при загрузке. Площадкам это безразлично: они требуют раскрытия ИИ в метаданных и смотрят на политику дистрибьютора, а не на происхождение модели: маркировка ИИ-музыки, можно ли выкладывать сгенерированные треки.

По российскому праву полностью сгенерированный трек не охраняется независимо от того, где он сделан. Охраняется ваш вклад — текст, записанный вокал, аранжировка в DAW: авторские права на ИИ-музыку. Vocal2BGM здесь в выгодном положении: мелодия и исполнение ваши, сгенерирован только аккомпанемент.

Услуга PushMusic

Выпустим трек из ACE-Step на площадки

Оформим раскрытие ИИ в метаданных, проверим файл и обложку, подберём дистрибьютора, который принимает ИИ-контент, и доведём релиз до стримингов.

ACE-Step или Suno: что выбрать

КритерийACE-StepSuno
Цена0Pro от $10/мес
Лимитынеткредиты и скачивания
Русский вокалслабеесильнее
Правки фрагментаRepaint бесплатноограниченно
Аккомпанемент под свой вокалVocal2BGMUpload и Cover на платных тарифах
Дообучение под свой стильLoRAPersona
Работает из Россиида, локальнода, оплата зарубежной картой
Риск закрытиянетесть

Практичный вариант — не выбирать. ACE-Step для черновиков, аранжировок под свой вокал и экспериментов без счётчика; Suno или Mureka — для финальной генерации, где важен русский вокал. Место локальных моделей в наборе музыканта из России: российские нейросети и что работает без VPN.

Коротко

  • ACE-Step 1.5 — открытая модель песен с вокалом, лицензия MIT, работает локально без лимитов.
  • Базовая версия — от 6 ГБ видеопамяти, Mac и AMD поддерживаются; XL — от 12 ГБ.
  • Умеет кавер, дописывание, Repaint, аккомпанемент под ваш вокал и дообучение на 8 песнях.
  • Русский вокал слабее, чем в Suno и Mureka; помогают теги языка и короткие строки.
  • Для релиза: маркировка ИИ и лояльный дистрибьютор. Авторское право — только на ваш вклад.
Услуга по теме
Бесплатный инструмент
Бесплатно покажем LUFS, true peak и запас по динамике.
❤️

Частые вопросы

Открытая модель генерации музыки с вокалом от команд ACE Studio и StepFun. Запускается локально, распространяется по лицензии MIT, делает треки от 10 секунд до 10 минут по тексту и описанию стиля.

Для базовых моделей 1.5 — видеокарта с 6 ГБ памяти минимум, 8–16 ГБ комфортно; поддерживаются NVIDIA, AMD, Intel и Mac с Apple Silicon. Для 1.5 XL — от 12 ГБ с выгрузкой в оперативную память или от 20 ГБ без неё.

Русский в списке поддерживаемых языков, но пользователи отмечают, что слова растягиваются на несколько долей и хуже попадают в ритм, чем в английском. Помогает явный тег языка перед куплетом и короткие строки.

Да. Модель и код открыты, лицензия MIT не требует платы и не ограничивает коммерческое использование результата. Платите только за электричество или аренду сервера, если своей видеокарты нет.

Вокал менее естественный, особенно на русском, стиль хуже держится на длинных треках, интерфейс проще. Зато нет лимитов на генерации и скачивания, материал не уходит на чужой сервер, и сервис нельзя закрыть.

Да, по общим правилам для ИИ-музыки: раскрытие ИИ в метаданных и дистрибьютор, принимающий такие релизы. Разрешение от сервиса не требуется — его нет, но авторское право на полностью сгенерированный трек в России тоже не возникает.

Ещё 1488 вопросов по теме «Технические вопросы»

Похожие вопросы

Менеджер PushMusicонлайн · отвечаем за 5–15 минут

Остался вопрос по теме?

Напишите в чат — отвечает живой менеджер, а не бот. Круглосуточно, без выходных.

Можно сразу прислать ссылку на трек: посмотрим карточку, метаданные и площадки — и скажем, что делать дальше. Бесплатно.

Быстрые вопросы

Открыть чат в Telegram

Нет Telegram? Спросите здесь

Ник, почта или телефон — что удобнее
Или сразу к услугеПроверьте мастер перед релизом

Ничего не спишем и не подпишем без вашего согласия. · Выпустить релиз

Термины из статьи

Похожие статьи

Технические9 мин

Suno v6: что стало со старыми треками и лицензиями

9 сентября Suno отключила все модели до v6. Что теперь с треками на v5.5, чем различаются v6, v6-wild и v6-mini и чем грозит новый иск.

Читать далее
Технические6 мин

ElevenLabs Music: нейросеть с лицензионным обучением — гайд 2026

Eleven Music делает песни до 10 минут и обучен на лицензированных каталогах: как пользоваться, что с русским, тарифы в кредитах и права на релиз.

Читать далее
Как настроить автотюн на голос в 2026: пошаговый гайд
Технические8 мин

Как настроить автотюн на голос в 2026: пошаговый гайд

Как настроить автотюн: тональность и гамма, скорость подстройки (retune speed), запись вокала и как не получить «робота». Рэп, фонк, поп.

Читать далее
Технические7 мин

Mureka AI: как пользоваться нейросетью для музыки в 2026

Mureka — генератор песен, где сначала текст, потом музыка: режимы, модели V8 и V9, тарифы в «золоте», русский вокал, права и оплата из России.

Читать далее