- Обработка голоса. Программы и запись голоса, динамическая компрессия.
- Базовая обработка голоса при и после записи. Динамическая компрессия.
- Первичная обработка голоса в процессе записи.
- Программная обработка голоса и специализированные плагины.
- Настройки компрессора. Стандартные параметры динамической компрессии.
- Основные настройки компрессора
- Настройки компрессора для голоса.
- Обработка вокала. Часть 2. Компрессия
- Обработка вокала с помощью инструмента Dynamics Processing
- Обработка аудио для ютуба и стримов: как сделать дикторский голос программными средствами
- Содержание
- Содержание
- Общие советы
- Обрабатываем звук для оффлайн-видео
- Обрабатываем звук в онлайне
- Дайте послушать результаты!
Обработка голоса. Программы и запись голоса, динамическая компрессия.
В звукозаписи, как и в любой другой профессиональной сфере деятельности, масса нюансов и правил. Это абсолютно точная «наука», которой необходимо учится! И учиться, не просто нажимать на кнопочку «запись», а учиться, как правильно записывать голос, в каких условиях и почему, учиться обработке голоса в теории, знакомиться и изучать программы для записи и обработки голоса. Практическая же сторона этого вопроса заключается уже в непосредственном использовании студийной аппаратуры и программ, а также их настройка. Безусловно, в бытовых условиях, каждый хочет обойти все сложности стороной и максимально упростить себе задачу, как минимум, если просто необходимо записать и обработать голос в домашних условиях. Также, для максимального упрощения работы со звуковыми файлами мы можем предоставить Вам простые, но очень полезные онлайн программы. К примеру, Вы можете с легкостью обрезать любой аудиофайл, используя наш онлайн аудио редактор.
Базовая обработка голоса при и после записи. Динамическая компрессия.
Запись голоса в домашних условиях и подбор микрофона, мы поверхностно рассматривали в нашей недавней статье, поэтому, если и вернемся к этому вопросу, то уж точно в другой раз. А сейчас, подойдем к этому вопросу более серьезно. Итак, в идеале, обработка голоса делится на 2 этапа – обработка голоса в процессе записи и обработка, уже записанного звукового файла. На первой стадии, мы используется микрофонные предусилители и «железные» компрессоры, вторая же стадия отводится программной обработке звуковых файлов специализированным студийным софтом.
Первичная обработка голоса в процессе записи.
Как мы уже отметили, чтобы качественно записать голос диктора, в тракте между микрофоном и компьютером – появляется микрофонный предусилитель и внешний компрессор. Для достижения мягкого и теплого звучания, специалисты рекомендуют использовать ламповые приборы, которые придают характерный «аналоговый» окрас воспроизводимому звуку. А вот что касается темы компрессоров, то ее можно разобрать более подробно. К слову, хорошее студийное «железо» стоит очень серьезных денег, поэтому если упомянуть о записи голоса в домашних условиях, то о такой роскоши разговоров просто и не будет. Компрессор в обработке голоса будет применяться дважды. Именно поэтому мы на ней и заострим внимание.
УЗНАЙТЕ, КАК ЗАКАЗАТЬ ГОЛОС ДИКТОРА ДЛЯ ЛЮБОГО ПРОЕКТА!
Программная обработка голоса и специализированные плагины.
Динамическая компрессия звука (Dynamic Compression) – это процесс сжатия диапазона сигнала звукового файла. Другими словами, это выравнивание громких и тихих фрагментов нашей аудиозаписи в соответствии с заданными параметрами. Ни один записанный файл не обходится без этого процесса! Т.е. программная обработка голоса не заканчивается только на этом, но компрессор — это основа основ и мы в нее углубимся!
Органы настройки «железных» (внешних) компрессоров при обработке голоса и программных плагинов ни чем не отличаются. Грубо говоря, мы программно «дожимаем» то, что не «дожали» во время записи. Почему же не накрутить все сразу, чтобы не возвращаться к этому в программах обработки звука или наоборот? Ответ прост. В процессе записи голоса диктора, мы используем компрессор и лимитер для первичного сглаживания пиков и исключения искажения звука при возможном «клиппировании» (чересчур громких моментах записи, которые выходят в «красную зону» датчиков). Программная же обработка голоса, необходима для достижения конечной цели, поэтому исходный голос должен быть и качественно записан, и одновременно быть «полуфабрикатом».
Настройки компрессора. Стандартные параметры динамической компрессии.
Сразу стоит подчеркнуть, что одной универсальной настройки компрессора не существует. Так как она абсолютно прямо зависит от исходного файла и поставленных задач. Но, тем не менее, есть стандартные параметры, которые используются, в том числе и в «пресетах», как базовые для дальнейшей точной подстройки. К примеру, мужские голоса и женские голоса, требуют внимания при перенастройке аппаратуры из-за особенностей разницы воспроизводимых частот.
Основные настройки компрессора
– Threshold. Это порог срабатывания компрессора. Он выражается в децибелах и определяет тот максимальный уровень сигнала, на котором начинает срабатывать компрессор и его понижать.
– Ratio. Степень сжатия сигнала. Т.е. соотношение компрессии сигнала с максимально допустимым порогом.
— Attack. Это время отработки компрессора. Выражается в миллисекундах и устанавливает время от момента превышения порогового сигнала и моментом достижения заданного соотношения Ratio.
— Release. Этот параметр указывает время в миллисекундах, когда сигнал упал до допустимого порога и моментом, когда компрессор перестал его понижать.
Настройки компрессора для голоса.
Повторимся, что не существует универсальных настроек, а есть всего лишь базовые настройки компрессора для голоса, от которых можно отталкиваться. Дикторы же, настраивая свою аппаратуру, руководствуются характеристиками собственного голоса и их настройки могут «в корне» отличаться друг от друга. А большинство плагинов-компрессоров выставляют усредненные настройки для обработки голоса. Мы же можем предложить следующие параметры.
— Если Ваш файл имеет достаточно большой «разнос» пиков графика, то необходима достаточно большая компрессия. Мы можем использовать такие настройки компрессора обработки голоса:
Attack time = 0.3 ms
Release time = 40ms
Threshold = -3 dB
Ratio = 4:1
— Если же у Вас график с незначительными скачками, то начнем компрессию голоса вот так:
Attack time = 0.3 ms
Release time = 50ms
Threshold = -8 dB
Ratio = 2:1
Что же, с базовой обработкой голоса мы немного разобрались. Далее можно переходить к следующему шагу – обработке голоса эффектами. Но эффекты для голоса, это очень обширная тема и мы, пожалуй, выделим ей полноценную статью. Не хочется говорить о таких серьезных вещах вскользь, т.к. это на самом деле очень интересный процесс и есть очень много отличных эффектов, которые применимы для разных целей.
Источник
Обработка вокала. Часть 2. Компрессия
Важной частью процесса обработки вокала является его компрессия — уменьшение динамического диапазона сигнала. Что это означает?
Во время записи вокала, одни его части звучат громче других. Всё это происходит по нескольким причинам. Первая – это отдаление и приближение к микрофону вокалиста в процессе пения. Вторая – разница в громкости при пении куплетов и припевов. Обычно припевы получаются более громкими из-за более эмоционального исполнения.
Обработка вокала с помощью инструмента Dynamics Processing
Для устранения разницы в громкости применяются специальные приборы динамической обработки звука, называемые компрессорами.
Рассмотрим процесс обработки вокала инструментом Dynamics Processing программы Adobe Audition 3.0
1. Запустим программу Adobe Audition 3.0 и загрузим наш вокал, выбрав в меню File / Open. На графике волновой формы вокала отчетливо видна разница в громкости на разных участках. Также мы можем увидеть превышение сигналом порога в 0 дБ, что чревато появлением клиппирования.
2. Используем для обработки вокала инструмент Dynamics Processing. Для этого выберем в меню Effects / Amplitude and Compression / Dynamics Processing.
3. Настраиваем плагин. Для этого давайте рассмотрим 4 его вкладки.
Вкладка Graphic используется для прорисовки графика компрессии.
По горизонтальной оси регулируется уровень входного сигнала, а по вертикальной – выходного. Инструмент может быть использован как компрессор, лимитер, экспандер или гейт.
На этой вкладке вы можете добавлять на график дополнительные точки и регулировать их положение по необходимости.
На вкладке Traditional настройки плагина представлены в более привычном виде. Здесь можно настроить порог срабатывания (Threshold), коэффициент компрессии (Ratio) и режим работы плагина для шести точек, а также уровень сигнала на выходе после компрессии.
Вкладка Attack / Release предназначена соответственно для настроек параметров атаки (скорости срабатывания) и восстановления (скорости выключения). Здесь также можно увеличить уровень выходного сигнала.
Вкладка Band Limiting предназначена для выбора диапазона компрессирования с помощью параметров Low Cutoff (отсечение сигнала, который находится ниже заданного порога) и High Cutoff (отсечение сигнала, который находится выше заданного порога).
Для правильной настройки компрессора установите следующие значения: Threshold – 0 дБ, Ratio – 2, Attack – 2-10 мс, Release – 150 мс. Начинайте опускать порог срабатывания (Threshold) пока не почувствуете, что сигнал подвергается обработке. После этого, начинайте подбирать соответствующую степень сжатия с помощью параметра Ratio. Это значение колеблется в пределах 2:1 – 8:1. Большие значения могут сделать вокал сухим и безжизненным. Будьте аккуратны, постоянно сравнивайте обработанный сигнал с необработанным.
Если вы услышите так называемую «накачку» (один из нежелательных артефактов) сигнала в промежутках между фразами, попробуйте увеличить время восстановления или поднять порог срабатывания. Если теряется артикуляция отдельных слов, отрегулируйте атаку.
Я выставил следующие параметры:
Threshold — -17, 5
Ratio – 3, 98: 1
Attack – 8 мс
Release – 270 мс
Output Gain – 5 дБ
Вы можете увидеть эти параметры на рисунках выше.
4. После выполнения необходимых настроек нажимаем Ок.
Давайте сравним вокал до обработки и после.
Послушаем голос до обработки.
Послушаем голос после обработки
Как видим динамический диапазон стал намного уже. Теперь весь вокал имеет приблизительно одинаковый уровень громкости.
Хочется отметить, что для компрессии вы можете использовать более удобные и привычные для вас компрессоры, например Waves C1, Tube-modeled Compressor программы Adobe Audition и многие другие.
На этом этап обработки вокала с помощью компрессии можно считать завершённым.
В следующей статье поговорим о коррекции вокала с помощью инструмента Melodyne.
Источник
Обработка аудио для ютуба и стримов: как сделать дикторский голос программными средствами
Содержание
Содержание
Создание видеороликов, трансляция подкастов и стримов — все это становится популярнее с каждым годом. Растущая конкуренция выдвигает больше требований к качеству контента, особенно к технической части — мало кто будет терпеть хрипящий звук и едва различимую речь, которую заглушает фоновая музыка. В этой статье рассматриваются базовые методы обработки голоса, которые помогут сделать его сопоставимым по качеству с речью профессионального диктора или радиоведущего.
Общие советы
Стоит сразу оговориться: хорошего результата не получится без хороших «сырцов» — исходный материал должен быть качественным. В идеале, речь должна не только записываться на хороший микрофон и звуковую карту, но и быть начитанной с дикцией, произношением, интонациями, выразительностью, характером, манерой и правильным дыханием. Возможные дефекты речи — ярко выраженная картавость или гнусавость — обработкой не исправляются.
Идеально, если речь записана в акустически обработанной комнате. Если таковой нет, можно обойтись акустическим экраном для микрофона. Расстояние до микрофона индивидуально и зависит от громкости голоса, экспрессии и динамики. Главное, чтобы не было перегрузов или откровенно тихого сигнала. Оптимальное значение — от -18 до -12 дБ.
На микрофоне обязательно должна быть либо ветрозащита, либо поп-фильтр. Взрывные согласные сложно поддаются компьютерной обработке, так что лучше приобрести недорогой аксессуар, который избавит от большинства проблем с ними.
Набор неплохих бесплатных плагинов от DAW Reaper можно скачать с официального сайта — там есть все необходимое. Для тех, кто всерьез увлечется звукорежиссурой, можно посоветовать более продвинутые пакеты плагинов от Waves, Fabfilter, Softube — их существует множество на любой вкус.
Обработку стоит выполнять на студийных мониторах или в наушниках студийного уровня. Без качественного контроля будет сложно разобрать, что вообще происходит с аудиосигналом.
Обрабатываем звук для оффлайн-видео
Итак, голос записан, и теперь нужно его обработать.
Начать стоит счистки материала: убрать все шумы в паузах, если необходимо — вдохи, вздохи и другие артефакты. Можно сделать все вручную, а можно поставить нойз-гейт. Он должен находится в самом начале цепи обработки. Настроить гейт очень просто: параметр threshold означает порог его срабатывания, здесь нужно взять самый громкий участок с шумами и сделать уровень thrershold чуть выше его. Attack — как быстро гейт «открывается» для пропуска полезного сигнала, release — как быстро он «закрывается» для удаления шума. Главное, чтобы гейт не откусывал слишком тихие слова.
Следующий шаг — шумоподавление. Нужно найти участок записи без какого-либо сигнала, чтобы на нем присутствовал только шум цепи звукозаписи. Если уровень шума ниже 50 дБ (как на скриншоте выше) — можно смело махнуть на него рукой и не делать ничего, такой шум никто не услышит. Если шум явно заметен, можно использовать специальные плагины (например, reafir от Reaper или denoiser в Cubase) для его удаления, либо подрезать эквалайзером пару самых шумных частот — точно так же, как будут удалятся резонансы в следующем пункте.
Фильтрация и удаление резонансов. Бывает, что низкий мужской голос начинает неприятно бубнить в районе 100–200 Гц, либо высокий женский тембр в сочетании с не самым лучшим микрофоном неприятно режет по ушам. Так и проявляются резонансы. Избавиться от них просто: нужно поставить в цепь обработки эквалайзер и узкой полосой с большим усилением (10–30 дБ) “пройтись” по всему частотному спектру, вычисляя самые неприятные места с режущим ухо свистом, звоном или гудением. Их необходимо ослабить узкой полосой на 3–5 дБ. Главное здесь не перестараться — удаления всего двух-трех основных резонансов обычно хватает для дикторского голоса.
Поиск и подрезание резонанса
Помимо этого, можно вовсе удалить целые куски спектра, в которых нет никакого полезного сигнала. Это делается с помощью low-pass и hi-pass фильтров, которые обрезают высокие и низкие частоты соответственно.
Чаще всего проблемы встречаются в следующих областях:
● Ниже 75–100 Гц — здесь находится, в основном, низкочастотный бубнящий шум. Можно смело применить hi-pass фильтр и обрезать все до этих значений.
● 100–150 Гц — тут нередко находятся гудящие частоты, особенно это касается мужского вокала, записанного в небольшой комнате. Можно подрезать их узкой полосой.
● 800–1000 Гц — здесь может располагаться «гундосый» назальный тон, который также имеет смысл подрезать узкой полосой.
● 4–9 кГц — тут находятся сибилянты — шипящие согласные звуки «с-с-с», «ш-ш-ш», «щ-щ-щ», которые могут неприятно свистеть при записи. Для борьбы с ними обычно используется деэссер — специальный прибор, который смягчает резкость свистящих согласных. Но можно не заморачиваться, найти самую неприятную частоту и также подрезать ее узкой полосой.
● Выше 16 кГц — в человеческой речи редко присутствует что-то полезное выше этой частоты, так что можно смело применять low-pass фильтр.
Так выглядит эквалайзер после вырезания резонансов и ненужных частот
Добавление недостающих частот. Теперь, когда остался только полезный сигнал, нужно сделать его четче и ярче. В качестве отправной точки будут полезны следующие данные:
● 180–240 Гц — прибавление 3–5 дБ широкой полосой в этой области сделает мужскую речь более полной и читаемой. Для женской речи это будет 200–300 Гц.
● 1.5–2 — 5 кГц — это самый важный диапазон для голоса, так называемая область разборчивости. Человеческий слух наиболее чувствителен именно к этим частотам, стоит прибавить их широкой полосой на 3–8 дБ.
● 9–11 кГц — эти частоты отвечают за яркость голоса. Их очень часто не хватает в речи, записанной даже на студийный микрофон, особенно в заглушенной комнате, которая с аппетитом пожирает верха вокала. Нередко приходится значительно прибавлять этот диапазон — на 6–12 дБ, чтобы придать речи ясности. Но нужно следить за шипящими согласными.
● Выше 12 кГц — это область «воздуха», поднятие которой позволит сделать речь более натуральной и яркой. Обычно для этой и предыдущей области частот используется параметр эквалайзера hi-shelf, который выглядит как «планка» и позволяет моментально «осветлить» голос.
При эквализации низких частот лучше использовать узкие полосы, а при высоких — широкие, это сделает работу эквалайзера менее заметной.
Компрессия. Компрессором убирается разница между громкими и тихими участками записи. В итоге голос будет звучать равномерно, от хлопков и кашля слушатель не будет вздрагивать, а при шепоте ему не придется прибавлять громкость. Понять работу компрессора поможет аналогия с громкой музыкой в комнате, которая не нравится соседу за стенкой. Параметр threshold будет тем критическим уровнем громкости музыки, при превышении которого сосед начинает тарабанить по батарее монтировкой; attack — как быстро он бежит к батарее при превышении этого уровня; ratio — насколько нужно убавить громкость, чтобы успокоить соседа; а release — как долго сосед перестает возмущаться после убавления громкости. Сосед-компрессор заставляет несчастного меломана держать уровень громкости музыки в определенных пределах. Начать настройку можно со следующих значений:
● Ratio: 4:1 (таким образом, если сигнал превышает порог на 4 дБ, то он скомпрессируется до 1 дБ выше порога)
● Attack: как правило, для голоса хорошо работает быстрая атака в районе 5–10 мс, она позволяет компрессору срабатывать мгновенно. Если при этом компрессия начинает съедать согласные — атаку нужно увеличить.
● Release: если в компрессоре есть функция авторелиз, можно ей и воспользоваться. Если нет — начать стоит с 40–50 мс.
● Output или make-up: если в компрессоре есть функция автомейкапа, можно применить ее. В противном случае компенсацию громкости можно выполнить вручную на слух — главное, чтобы итоговый сигнал не попадал в красную зону.
● Threshold: здесь нужно смотреть по уровню громкости исходного трека. Начать можно с -8 дБ.
Есть проверенный метод настройки компрессора «на слух» для новичков: нужно выкрутить ratio и threshold на максимум, attack и release — на минимум. Так будет лучше слышно, что прибор делает с сигналом. Далее подбирается атака, потом релиз, а параметрами ratio и threshold регулируется уровень до желаемых значений. Как правило, уровень компрессии отображается на индикаторе «вверх ногами», ведь компрессор работает на понижение сигнала. Параметр threshold следует установить таким образом, чтобы компрессор срезал около 6 дБ для тихого голоса и около 12 дБ для громких участков.
Лимитеринг. Это операция позволяет ограничить максимальный уровень громкости. Сигнал на мастер-шине не должен зашкаливать, и лимитер выступает в роли очень жесткого компрессора, который не позволяет сигналу выбраться за пределы установленного значения. Как правило, среднее арифметическое уровня сигнала (RMS) должно быть около -16 дБ. При рендере на мастер-шине нужно выставить уровень -0.5 дБ, потому что финальная конвертация аудио может сделать звук громче и добавить искажений. При отсутствии лимитера его роль может сыграть компрессор: достаточно выставить ratio на максимум, threshold на -0.5 дБ, и атаку на минимум.
Лимитер и компрессор в роли лимитера
Если фоновая музыка в видео заглушает речь, нужно выставить RMS музыки и RMS голоса одинаковыми, после чего убавить музыку на 5–10 дБ. Если в некоторых местах слова все еще неразборчивы, можно применить к музыкальной подложке эквализацию. Достаточно посмотреть на эквалайзер для речи и сделать все наоборот в эквалайзере для музыки: например, если в речи 5 кГц приподнято широкой полосой, то в музыке эти же 5 кГц нужно убавить.
Обрабатываем звук в онлайне
У стримов и подкастов есть своя специфика при обработке голоса — здесь важно, чтобы плагины не были ресурсоемкими и не сильно грузили компьютер. Поэтому стоит использовать минимально необходимый набор эффектов.
Чаще всего для стримов используется программа OBS Studio. В ней можно загружать точно те же VST-плагины для обработки звука, что и в DAW. Если используется не OBS Studio, то для обработки голоса можно воспользоваться отдельной программой для потоковой обработки звука VSTHost, она работает с любыми приложениями для стримов.
Так выглядит плагин ReaFIR в OBS Studio
Для обработки голоса потребуется необходимый минимум:
1. Шумоподавление. В отличие от оффлайн-видео, звук к которым нередко записывается отдельно на качественный микрофон, в стримах часто используется не самое лучшее оборудование. Недорогой микрофон вкупе со встроенной звуковой картой и включенной функцией Microphone Boost в настройках звука Windows будут сильно шуметь. Для того, чтобы избавиться от этого шума, можно использовать встроенный в OBS фильтр Noise Suppression. У него всего одна настройка — уровень шумоподавления, начать стоит со значения около -20 дБ.
2. Гейт. Если в звуке для оффлайн-видео можно вручную вырезать все крики детей за окном и рев соседского перфоратора за стеной, то с онлайном такой фокус не провернуть. Понадобится гейт.
● Release можно сделать длинным, около 200 мс, поскольку работа гейта будет слишком слышна при быстром релизе. Правильно настроенный гейт почти незаметен для слушателя и удаляет лишь шумы и призвуки в паузах между фразами.
● Уровень гейта нужно сделать чуть выше, чем фоновый шум, не стоит выставлять уровень рядом с уровнем голоса.
● Простой способ настройки гейта для речи — нужно сложить губы трубочкой и шумно выдохнуть воздух в сторону от микрофона, запомнить на индикаторе значение уровня этого шума и выставить его на гейте.
3. Эквалайзер. Здесь все то же самое, что и для оффлайн-видео: нужно отфильтровать лишние частоты, вырезать пару самых противных резонансов и добавить частот в области разборчивости. Также стоит посмотреть на индикатор: если звук после обработки эквалайзером «пикует» в красной зоне, нужно прибрать выходной Gain, если, наоборот, слишком тихий — прибавить.
4. Компрессор. Для стримов он имеет даже большее значение, чем для оффлайн-видео — в онлайне ни один диктор не сможет уследить за динамикой своего голоса на протяжении нескольких часов. Следует быть готовым к тому, что речь будет то едва слышной, то слишком громкой. Поэтому нужно использовать более жесткие настройки компрессора, чем для оффлайн-видео. Начать можно с ratio 10:1, атаки 5 мс и релиза в 30 мс или автоматически.
При подобных настройках нет необходимости в лимитере — компрессор будет выполнять его роль. Но если динамика речи очень большая и не позволяет настроить гейт (то слова начинают обрезаться, то шум просачивается в эфир), тогда можно использовать два компрессора: первый, с более мягкими настройками (ratio 3:1) поставить перед гейтом, второй, в качестве лимитера — в конце цепи (ratio выкрутить на максимум, threshold — так, чтобы компрессор срабатывал только при очень громких фразах).
Дайте послушать результаты!
Разобраться в обработке звука по тексту бывает непросто, но результат того стоит. Смотрите сами. Точнее, слушайте.
Качественный звук в современных видео и стримах значит ничуть не меньше, чем видео в высоком разрешении. А порой и больше — ведь многие ставят ролики на фон, смотря их вполглаза и воспринимая происходящее в основном на слух.
При этом стоит учесть, что данное руководство дает лишь базовые настройки в качестве точки отсчета. Конечный результат должен подбираться аудиально, ведь главный инструмент в работе звукорежиссера — это его собственные уши.
Источник