Вокодер и токбокс: как сделать роботизированный вокал
Два разных способа заставить синтезатор говорить. Как настроить вокодер за пять минут, чем от него отличается токбокс и где это уместно в 2026 году.
- Два сигнала
- голос + несущаямодулятор и то, что звучит
- Несущая
- богатая обертонамипила или аккорд, не синус
- Доза
- 8 тактовкраска, а не весь трек
Короткий ответ
Вокодер накладывает спектр голоса на синтезаторный звук: вы поёте или говорите в микрофон, а звучит синтезатор, который «произносит» ваши слова. Для работы нужны два сигнала — модулятор (голос) и несущая (обычно пила или широкий синт-аккорд), и главная ошибка новичков в том, что несущую берут слишком бедной: у синусоиды нет обертонов, и разборчивости не получится. Токбокс устроен иначе: звук синтезатора подаётся по трубке в рот исполнителя, форма рта фильтрует его, и результат снимается обычным микрофоном — отсюда более живой, «разговорный» характер. В современной музыке оба приёма используются как краска: восемь тактов в проигрыше, ответ на вокальную фразу, эффект в припеве. Разборчивость повышают чёткой артикуляцией, подъёмом верхней середины и добавлением немодулированного шипящего слоя.
Роботизированный голос делают двумя принципиально разными способами, и оба живы: вокодером — цифровым или аппаратным, и токбоксом — через трубку в рот. Разница слышна: вокодер звучит ровно и синтетически, токбокс — живее и грязнее.
Как работает вокодер
Ему нужны два сигнала:
| Сигнал | Что это | Требование |
|---|---|---|
| Модулятор | ваш голос с микрофона | чёткая артикуляция |
| Несущая | синтезатор, который зазвучит | много обертонов |
Вокодер анализирует спектр голоса по полосам и применяет эту картину к несущей. Поэтому синусоида не годится: фильтровать в ней нечего. Берите пилу, широкий аккорд или шумный слой — синтезаторы: типы синтеза, саунд-дизайн: свои звуки.
Настройка за пять минут:
- Дорожка синтезатора с аккордом — это несущая.
- Дорожка голоса — модулятор, без реверберации и без сильной компрессии.
- Вокодер на несущей, боковой вход — с голоса.
- Играете аккорд и одновременно говорите фразу.
- Правите разборчивость: больше полос, ярче несущая, чётче дикция.
Подмешайте немодулированный слой с согласными. Возьмите копию вокала, оставьте в ней только верх — шипящие и щёлкающие звуки, — и добавьте тихо поверх вокодера. Слова сразу читаются, а синтетический характер сохраняется. Логика та же, что с де-эссером, только наоборот: там эти частоты убирают, здесь возвращают.
Токбокс
Звук синтезатора идёт в усилитель, оттуда — по трубке в рот исполнителя. Рот меняет форму, фильтрует звук, а обычный вокальный микрофон снимает то, что получилось. Технически это тот же принцип фильтрации, но фильтр живой, поэтому характер получается «говорящим» и чуть неряшливым.
Для записи это сегодня редкость: похожий результат даёт плагин. Для сцены — эффектный номер, но требующий репетиций и отдельной настройки мониторинга: мониторинг на сцене, работа с микрофоном на сцене.
Где это уместно
Как краска: восемь тактов в проигрыше, ответ на вокальную фразу, обработанный припев. На весь трек приём утомляет — исключение составляют жанры, где синтетический вокал и есть идея: как сделать синти-поп, как сделать синтвейв, как сделать фьючер-хаус.
Соседние приёмы, из которых собирается «нечеловеческий» вокал:
- Автотюн как эффект — жёсткая привязка к нотам: автотюн: что это и как настроить, как настроить автотюн.
- Питч-сдвиг и форманты — октава вниз или вверх без изменения темпа.
- Телефонный фильтр и мегафон — самый простой способ «обесчеловечить» фразу: эффекты на вокале.
- Нарезка вокала — ритмическая обработка вместо тембральной: вокальные чопы.
- ИИ-вокал — отдельная история с правами: нейросеть, которая поёт, AI-кавер голосом.
Как встроить это в трек
Готовые сценарии, которые не превращают приём в трюк:
| Сценарий | Что делает |
|---|---|
| Ответ на строку | вокодер повторяет последние два слова фразы |
| Проигрыш | восемь тактов вокодерного соло вместо синтезаторного |
| Слой в припеве | вокодер тихо под основным вокалом, добавляет объём |
| Интро | фраза-приветствие, задающая настроение трека |
| Хук без слов | короткий мотив на «а-а», обработанный вокодером |
Последний вариант чаще всего и уходит в короткие видео: его легко повторить, и он не требует понимания текста — как писать трек под короткие видео, как написать припев.
При сведении держите вокодер в стороне от основного вокала по частотам и панораме: два похожих тембра в центре дерутся друг с другом — вокал в миксе, панорама и стереокартина.
Что мешает чаще всего
Бедная несущая. Самая частая причина «каши» вместо слов.
Скороговорка. Вокодер требует медленной и утрированной артикуляции — дикция в рэпе.
Реверберация на входе. Модулятор должен быть сухим, иначе эффект размазывается — как записать вокал дома.
Слишком широкий диапазон. Ограничьте несущую по низу: бубнящий вокодер мешает басу — эквализация в сведении.
Коротко
Вокодеру нужны два сигнала: голос как модулятор и богатый обертонами синтезатор как несущая.
Синусоида не подходит: разборчивость появляется только там, где есть что фильтровать.
Разборчивость поднимают чёткой дикцией, верхней серединой и подмешанным слоем согласных.
Токбокс делает то же физически — через трубку и рот, — и звучит живее, но на записи его заменяет плагин.
Приём работает как краска на восемь тактов; на весь трек он утомляет, кроме жанров, где это и есть идея.
Частые вопросы
Автотюн правит высоту вашего голоса, оставляя его голосом. Вокодер заменяет голос синтезатором, который повторяет вашу артикуляцию: тембр целиком синтетический.
Богатый обертонами звук: пилу, широкий аккорд, шумный слой. Синусоида не работает — в ней нечего фильтровать, и слова превратятся в кашу.
Три причины: бедная несущая, вялая артикуляция и отсутствие верхней середины. Лечится выбором тембра, чёткой дикцией и подъёмом области согласных.
Приём, где звук синтезатора подаётся по трубке в рот музыканта, рот работает фильтром, а результат снимается микрофоном. Отсюда характерный «живой» говорящий звук.
Для записи — необязательно, тот же характер приблизительно повторяется плагинами. Для сцены это эффектный номер, но требует практики и отдельной настройки.
Подмешать немодулированный слой с шипящими согласными, поднять верхнюю середину и петь медленнее обычного: вокодер плохо переносит скороговорку.
В электронике, фанке, синти-попе, хип-хопе как краска. Как основной приём на весь трек он быстро утомляет.
Частично: похожего эффекта добиваются фильтрацией синтезатора по огибающей голоса или связкой из эквалайзера и компрессора с боковой цепью. Проще всего всё же взять вокодер.
Похожие вопросы
- Что править первым — время или интонацию?Тюнинг и тайминг вокала: как править дубли и не убить подачу
- Что сатурация делает со звуком?Сатурация: как добавить треку плотность без громкости
- Чем хорус отличается от флэнжера?Хорус, флэнжер и фейзер: модуляция в сведении
- Чем лимитер отличается от компрессора?Лимитер: как он работает и как не убить им трек
- На сколько процентов квантовать?Квантайз: как выравнивать ноты и когда этого делать нельзя
Остался вопрос по теме?
Напишите в чат — отвечает живой менеджер, а не бот. Круглосуточно, без выходных.
Можно сразу прислать ссылку на трек: посмотрим карточку, метаданные и площадки — и скажем, что делать дальше. Бесплатно.
Быстрые вопросы
Открыть чат в TelegramНет Telegram? Спросите здесь
Или сразу к услугеПроверьте мастер перед релизомНичего не спишем и не подпишем без вашего согласия. · Выпустить релиз
Термины из статьи
- Синтезатор
Инструмент, который создаёт звук с нуля — осцилляторами, фильтрами и огибающими, а не воспроизведением записи.
- Аккорд
Три и более ноты, звучащие одновременно. Базовая единица гармонии: из последовательности аккордов строится трек.
- Автотюн
Обработка, подтягивающая высоту вокала к нотам тональности. Бывает незаметной коррекцией и приёмом со слышимым эффектом.
- Реверберация
Хвост отражений, который ставит звук в пространство. Слишком много реверберации — и вокал уезжает вглубь микса.
- VST-плагин
Подключаемый модуль для DAW: инструмент или обработка. Формат VST понимают почти все секвенсоры, у Apple свой аналог — AU.
- Припев
Повторяющаяся часть песни с главной мыслью и самой сильной мелодией. Именно её запоминают и ищут по одной строчке.
- Вертикальное видео
Формат 9:16 под экран телефона — Shorts, Reels, VK Клипы. Основной способ довести музыку до людей, которые её не искали.
- Панорамирование
Размещение звука между левым и правым каналом. Главный инструмент ширины микса.
Похожие статьи
Эффекты на вокале: телефон, радио, мегафон и шёпот
Как сделать узнаваемые эффекты на голосе — фильтр телефона, радиопомехи, мегафон, дабл и шёпот — и где они помогают аранжировке, а где мешают.
Реверберация и дилей: как создать пространство в миксе
Чем реверб отличается от дилея, как синхронизировать задержку с темпом трека и почему пространство добавляют посылом, а не отдельным плагином на дорожке.

Как настроить автотюн на голос в 2026: пошаговый гайд
Как настроить автотюн: тональность и гамма, скорость подстройки (retune speed), запись вокала и как не получить «робота». Рэп, фонк, поп.
Шипящие в вокале: как работает де-эссер и когда он не нужен
Свистящие «с» и «ш» вылезают после компрессии. Где искать полосу, как настроить де-эссер и что решается позицией микрофона.

