A mixagem da voz é provavelmente um dos aspectos mais complicados da mixagem de áudio.
Simplesmente porque somos muito mais sensíveis ao realismo de uma voz em uma gravação do que ao realismo de uma guitarra elétrica ou de uma bateria.

Quando comecei a mixar minhas próprias músicas, tive muita dificuldade em entender o que fazer e por quê. Que tratamento adicionar, que ajuste aplicar a tal ou tal efeito.
Eu adicionava plugins seguindo os conselhos que tinha lido ou ouvido, mas sem entender o impacto que isso tinha na mixagem.
Tudo isso me parecia bastante misterioso, na verdade, …
… porque eu não dominava as etapas essenciais para a mixagem de uma voz.
Porque, de fato, embora não existam regras para ter sucesso na mixagem de voz, há um certo número de etapas padrão que são quase inevitáveis. E isso, quer você faça sua mixagem no FL Studio, Cubase ou qualquer outro DAW.
Aqui está, portanto, através deste artigo, uma visão detalhada e “passo a passo” do que fazer quando você começa a mixar uma faixa de voz principal.
Etapa 1: Defina um alvo
A maior erro que você pode cometer em relação à mixagem vocal é começar sem ter definido um som alvo.
Eu diria até que é aplicar conselhos que você ouviu aqui e ali, na Internet ou não, sem ter refletido sobre sua relevância em seu mix.
“Comprimir com uma razão de 6:1 e um ataque de 15 ms.”
“Adicione um equalizador e corte -5 dB com um filtro em sino a 1200 Hz”
…todos esses conselhos devem ser tomados com cautela porque:
- eles são aplicáveis apenas à música / à mixagem da pessoa que os dá, pois dependem 100% do sinal sonoro gravado;
- eles vão necessariamente variar de acordo com o gênero musical: não se comprime de forma alguma uma voz para jazz, para pop ou para hard rock.
É por isso que você não encontrará no Projet Home Studio quase nenhum número, nenhum “ajuste para uma boa mixagem de voz”, mas apenas diretrizes.
Mas então como fazer?
Bem, a primeira coisa a fazer antes de mixar uma faixa de voz é se perguntar sobre o som que você deseja.
Você está buscando um som agressivo, frontal?
Ou, ao contrário, algo suave e aéreo, com muitas variações dinâmicas?
Sua música se adaptaria melhor a uma voz muito seca ou ao contrário, a algo com muita reverberação?
Reserve um tempo para refletir sobre esse tipo de perguntas para definir seu som de voz alvo — se necessário, encontre uma música de referência que se assemelhe ao que você deseja fazer.
Isso permitirá que você mixe sua voz com um objetivo claro, que corresponderá à sua música.
Etapa 2: Prepare sua faixa de voz antes da mixagem
Geralmente, quando pensamos na mixagem de voz principal, pensamos imediatamente nos plugins que vamos adicionar.
É normal: essa é a parte mais divertida da mixagem.
No entanto, antes de começar a adicionar efeitos de qualquer tipo, é realmente importante preparar corretamente sua faixa de canto.
Se partirmos do princípio que a gravação é de boa qualidade, essa “preparação” se traduz em duas grandes ações: o comping e a edição.
O comping
Geralmente, para uma mesma linha de canto, você fará várias tomadas.
Nos anos 60, muitas músicas eram feitas em “uma única tomada”, especialmente porque as gravações eram feitas em fitas magnéticas.
Hoje, a tecnologia e as capacidades de armazenamento de nossos PCs permitem facilmente realizar três ou quatro tomadas para uma mesma música.
Consequência imediata: para uma linha de canto dada, você poderá selecionar os melhores trechos e combiná-los.
Por exemplo, se a 1ª frase é melhor na tomada A do que na tomada B, você vai manter a tomada A. E assim por diante para cada frase, cada verso… até que você obtenha uma faixa completa e perfeita!
Talvez você tenha a impressão de que isso é um pouco desonesto. Fique tranquilo: essa técnica, chamada comping, é utilizada pela maioria dos estúdios profissionais.
Exceto no caso do sucesso My Heart Will Go On, mas nem todo mundo é Céline Dion! 😉
Então, leve o tempo necessário para fazer várias tomadas e compile-as em uma única faixa.
Dica: para ajudá-lo a selecionar as partes da sua música, você pode usar uma comp sheet como esta, anotando as melhores passagens:

A edição
Mesmo em boas tomadas de som, sempre há coisas que não queremos manter, como ruídos de respiração ou o som do fone de ouvido no microfone durante passagens calmas.
No contexto de home studio, dependendo das condições em que você grava, isso pode ser muito pior:
- ruído de fundo do computador;
- ruído de fundo do ar-condicionado;
- um pássaro ou um carro do lado de fora;
- …
Quando o cantor ou a cantora canta, esse tipo de ruído geralmente é coberto, então não causa muitos problemas (mas desligue seu ar-condicionado enquanto grava…).
Por outro lado, nas passagens calmas entre as frases ou os versos, é absolutamente necessário remover essas anomalias, sob o risco de que elas se destaquem ainda mais durante a mixagem devido à compressão.

Para isso, você só precisa:
- cortar as partes que você não deseja manter usando a ferramenta adequada do seu DAW;
- e então adicionar fades rápidos no início e no final de cada stem de áudio para evitar que cliques digitais apareçam.
No final, você terá uma faixa de voz o mais limpa possível, que será mais fácil de mixar.
Etapa 3: Ganho de nível
Uma vez que sua faixa foi corretamente editada, geralmente é o momento certo para ajustar o nível das frases ou sílabas.
Em outras palavras, para fazer uma espécie de ganho de nível.
Essa etapa é super importante porque realmente fará a diferença entre uma mixagem amadora e uma mixagem profissional.
Pelo menos no que diz respeito à mixagem das vozes principais.
Vamos imaginar que você tenha uma faixa de canto com passagens suaves e passagens fortes:

Se você deixar a faixa assim e tentar comprimi-la, você encontrará o seguinte problema:

- se você comprimir com um limite alto, apenas as passagens fortes serão afetadas;
- mas se você abaixar o limite para levar em conta as passagens de baixo nível, as passagens fortes serão completamente esmagadas pela compressão porque estarão bem acima do limite.
Por outro lado, ajustando frase por frase, verso por verso, ou até sílaba por sílaba o nível da faixa, você evitará problemas ao adicionar efeitos e poderá garantir que cada palavra seja inteligível na mixagem.
Não é sempre necessário ir até a sílaba, mas certifique-se de que, em média, as frases estejam no nível correto.
Para isso, você pode usar um plugin de ganho simples com uma curva de automação, ou usar um plugin de ajuste automático de ganho como o Vocal Rider da Waves.
Vale notar que este último pode gerar uma curva de automação automaticamente, que você poderá, se necessário, editar manualmente para ser um pouco mais preciso.
Etapa 4: Equalização subtrativa
Na maioria das vezes, a primeira coisa que você vai precisar fazer ao mixar uma voz principal, é limpá-la usando a equalização.
Ou mais precisamente, corrigir as frequências que não parecem agradáveis.
Tipicamente, frequentemente encontramos ruídos graves abaixo de 50-100 Hz, que correspondem mais a ruídos de fundo (elétricos, externos…) do que à própria voz.
Tudo isso pode ser removido ou atenuado facilmente com filtros passa-alta (ou low-shelf).
Em seguida, será necessário corrigir os outros problemas de frequência que você ouve.
Esses podem estar relacionados a todo tipo de causas mais ou menos controláveis, como:
- a acústica do ambiente onde você grava (sem tratamento acústico, você pode, por exemplo, sofrer o efeito de ressonâncias modais);
- frequências um pouco duras ao ouvido relacionadas à construção do microfone e/ou à qualidade do pré-amplificador;
- frequências um pouco incômodas da voz que se destacam mais com um microfone do que com outro (isso depende dos cantores/cantoras);
- a qualidade da performance do cantor / da cantora.

Para corrigir esses problemas, o mais simples é usar a técnica usual de equalização clássica:
- Identifique o problema ou o elemento que você deseja corrigir
- Adicione um filtro EQ em forma de sino com
- um fator Q relativamente alto (4 a 10)
- uma amplificação alta (+10 dB, por exemplo)
- Percorra lentamente o espectro de frequências com este filtro até ouvir o problema se destacar de forma intensa (sob a forma de ressonância, por exemplo)
- Atenue o sinal (em vez dos +10dB) no nível da faixa de frequências em que você se encontra, ajustando conforme necessário o fator Q
Eu insisto particularmente no primeiro ponto: tire um tempo para ouvir primeiro sua faixa para identificar os elementos que o incomodam. De fato, a mixagem de vozes pode ser algo preciso, mas é desnecessário corrigir pequenos problemas que não são audíveis no geral, mas que seriam destacados por causa do filtro a +10 dB…
Uma vez que esta etapa esteja concluída, seu EQ pode parecer com isso (mas pode ser algo completamente diferente, pois sempre depende do sinal de origem):

Note que estamos falando de uma equalização para uma voz principal. Se, por exemplo, você estiver mixando coros, a equalização será sem dúvida muito diferente.
Etapa 5: De-Esser
Algumas letras ou sílabas tendem a se destacar de forma agressiva nos agudos uma vez gravadas por um microfone.
Tipicamente, trata-se de sons como a consoante “S”, mas também de “F”, “T” ou “CH”.
É um fenômeno de áudio que chamamos genericamente de sibilância e que pode aparecer de forma mais ou menos forte dependendo do microfone e da forma da boca do cantor/cantora.
O fato de esses sons se destacarem pode ter uma série de consequências desagradáveis para sua mixagem: por um lado, isso pode ser rapidamente irritante para o ouvinte, mas também pode prejudicar os efeitos de reverb que você adicionará posteriormente, que são muito sensíveis a esses sons.
Ouça, por exemplo, o efeito dos “S” na textura do reverb neste exemplo:
Portanto, é importante controlar ao máximo esse fenômeno de sibilância.
Certamente, existem dicas de gravação de voz que permitem minimizar a questão, mas muitas vezes você precisará tratar o problema na mixagem.
Infelizmente, é impossível usar um simples equalizador para cortar o sinal nas faixas de 4 ou 5 kHz: se você cortar constantemente, isso afetará toda a pista e a voz ficará estranha.
A solução, portanto, é usar o que chamamos de de-esser como o Pro-G da Fabfilter (ou uma dessas alternativas gratuitas):

Através de um algoritmo multibanda, esse efeito permitirá que você controle a sibilância atenuando apenas certas frequências quando sons do tipo “S” forem detectados.
Portanto, sem afetar as frequências que não estão relacionadas ao problema.
Entretanto, cuidado para não ajustar o plugin de forma muito extrema, sob o risco de degradar o sinal: alguns decibéis de redução de ganho (GR) devem ser suficientes na maioria dos casos.
Etapa 6: A compressão, inevitável para a mixagem das vozes
Com o sinal agora limpo, você poderá passar para a compressão da pista de voz.
Às vezes, você não precisará de compressão. Talvez porque o gênero musical não permita, ou porque já houve uma compressão analógica durante a gravação.
Dito isso, 99% das vezes, as gravações de voz ou canto acabam sendo bastante dinâmicas: algumas frases, algumas sílabas se destacarão enquanto outras ficarão menos evidentes.
Consequência: impossível fazer com que todas as palavras se destaquem de forma inteligível na mixagem. Em outras palavras, se você tentar ajustar o fader de volume da sua pista de voz, não conseguirá encontrar uma configuração que funcione: em alguns momentos a pista estará muito alta e você vai querer baixar o fader, e em outros momentos as letras estarão perdidas na mixagem e você vai querer aumentar o fader.
Isso é um sinal de que sua pista precisa de compressão para que sua faixa dinâmica seja reduzida.
Adicione, portanto, o compressor de sua escolha na pista (para começar, o que vem por padrão no seu DAW pode ser um bom ponto de partida) e ajuste-o para nivelar sua pista:

A quantidade de compressão que você vai aplicar, que corresponde à redução de ganho (Gain Reduction ou GR), vai depender do estilo musical: em música acústica ou jazz, você provavelmente vai buscar um efeito minimalista, enquanto em rap ou heavy metal você precisará de uma voz muito mais frontal, muito mais “impactante”.
Dito isso, o objetivo ainda é que o efeito de compressão seja o menos audível possível, uma vez que a compressão pode gerar artefatos de áudio (tipicamente, um efeito de pumping).
Se um único compressor não for suficiente para homogeneizar o nível da pista de voz, não hesite em usar dois em sequência para tratar diferentes aspectos da pista (visite meu guia sobre compressão de voz para mais explicações).
Etapa 7: Equalização aditiva
Após a compressão, geralmente é o momento certo para adicionar um EQ que vai trabalhar de forma aditiva, ou seja, com ajustes de ganho positivos.
A ideia é que agora que você removeu os problemas do sinal graças à equalização subtrativa (ou ao eventual de-esser) e que a dinâmica está corretamente controlada pela compressão, você vai refinar a resposta em frequências amplificando o que você quer ou precisa ouvir mais.
Em outras palavras, você vai melhorar a mixagem da sua pista de voz escultando seu som.
Fica a seu critério ver as frequências a serem amplificadas e a quantidade de ganho a ser aplicada, mas por exemplo, é comum amplificar um pouco os graves para dar mais corpo à voz ou elevar os agudos para, ao contrário, dar mais ar e ajudar a voz a se destacar na mixagem.
Aqui está um exemplo de uma música onde os agudos são levados ao extremo (não muito agradável, mas enfim…):
Isso me leva a um ponto de atenção: é claro que eu não gosto muito de dar regras ultra-precisas, mas se você perceber que sua equalização ultrapassa os +5 ou +6 dB, pergunte-se “o que estou fazendo faz sentido?”.
Enquanto em uma bateria isso pode ser facilmente compreendido, deformar uma faixa de voz pode ser muito rápido — é por isso que é necessário ter cuidado.
Exemplo: em vez de aumentar os agudos em +15 dB, talvez o mix geral esteja muito forte nos agudos? Nesse caso, reduza os agudos em outras faixas em vez de deformar a faixa de voz… 😉
Etapa 8: Saturação (opcional)
É completamente opcional, mas às vezes pode ser interessante adicionar saturação harmônica.
Isso pode ser saturação levada ao máximo para gerar um efeito especial tipo distorção, mas por padrão eu aconselho a ficar com configurações de saturação mais sutis.
A ideia é reforçar o conteúdo harmônico do sinal para tornar o som um pouco mais quente, um pouco mais interessante, um pouco mais notável no mix.
Note que essa técnica não é específica para a mixagem de vozes: ela pode ser aplicada em todos os tipos de instrumentos.

Claro, se a gravação já foi feita com um pré-amplificador colorido (tipo Neve, por exemplo), adicionar saturação novamente pode não trazer muito — ou até mesmo prejudicar a qualidade do mix.
Por outro lado, se o pré-amplificador utilizado é neutro (o que é o caso da maioria dos pré-amplificadores integrados nas placas de som) ou tende a dar um resultado bastante plano, então provavelmente vale a pena adicionar um pouco de saturação cosmética, usando plugins que simulam fitas magnéticas, por exemplo.
Algumas recomendações de plugins:
- Kazrog True Iron ;
- Waves J37 (-10% com este link e o código que aparece) ;
- Soundtoys Radiator ;
- ou por exemplo um dos plugins de saturação gratuitos.
Etapa 9: Compressão paralela (opcional)
É claro que todo tipo de tratamento pode ser aplicado às vozes.
O objetivo deste artigo não é listar a infinidade de possibilidades existentes — senão você ficaria simplesmente perdido(a) no meio de todas essas informações (sabendo que já há muito nesta página 🙂 ).
No entanto, uma técnica que é ao mesmo tempo muito prática e comumente utilizada é a chamada “compressão paralela” ou “Compressão de Nova York”.
Esse método consiste em comprimir fortemente uma faixa idêntica à faixa de voz original e depois remixá-la sutilmente com o sinal original.
Isso permite manter os picos e parte da dinâmica do sinal, mas apoiando “por baixo” os sons mais fracos, o que resulta em destacar facilmente a voz no mix em relação aos outros instrumentos.
Para mais informações, convido você a consultar meu tutorial sobre compressão paralela.
Etapa 10: Reverb e Delay
Finalmente, a última etapa consiste muitas vezes em posicionar a voz principal em um espaço estéreo, em três dimensões.
Ou seja, adicionar reverb à sua faixa de voz.
Por padrão, eu aconselho a fazer isso por último para evitar que o efeito oculte certos defeitos ou problemas do seu mix.
Por fim, eu digo reverb, mas também é possível usar outros efeitos como, por exemplo, delays.
Simplesmente, isso depende dos estilos musicais e da densidade do efeito que você está buscando.
Reverb
Para tornar a voz menos seca, adicionar um plugin de reverb é frequentemente a solução mais simples.
De fato, esse efeito permite instantaneamente tornar uma voz mais interessante, dando-lhe uma dimensão estéreo.
A contrapartida é que quanto mais reverb você colocar em uma voz, mais ela parecerá distante:
A duração do reverb e seu volume relativo em relação à pista de voz serão, portanto, dois parâmetros críticos que você precisará dominar:
- um reverb muito longo vai afogar o sinal original e as letras serão menos inteligíveis;
- um reverb muito forte dará uma sensação de afastamento da fonte sonora.
Assim, para alguns gêneros musicais modernos que exigem uma voz muito frontal na mixagem, pode ser necessário abrir mão do reverb.
Além disso, o tipo de reverb também influenciará sua eficácia dentro da mixagem.
Pessoalmente, tenho uma pequena preferência por reverbs de placas (notavelmente Abbey Road Reverb Plates da Waves: -10% com este link e o código que aparece) assim como por alguns reverbs algorítmicos (como os da ValhallaDSP).
Mas você é livre, claro, para experimentar com todas as saídas de plugins.
Delay
Quando um reverb não é adequado para dar dimensão a uma pista de voz, pode ser interessante usar um efeito de delay (ou eco em francês, é a mesma coisa).
Isso pode parecer surpreendente, pois o delay é frequentemente percebido como um efeito especial, mas é, no entanto, um efeito comumente utilizado na mixagem de vozes.
Mais especificamente, muitos engenheiros usam uma técnica chamada slapback delay — muito simples, mas extremamente eficaz para dar profundidade a uma voz.

Concretamente, isso consiste na utilização de um plugin de delay configurado da seguinte forma:
- um tempo de eco extremamente curto (50-100 ms em média);
- uma única repetição (portanto, uma configuração de feedback a 0%);
- mono apenas (a repetição do sinal no canal esquerdo é idêntica à do canal direito).
Claro, equalizar o efeito de eco é necessário para evitar que ele se sobreponha demais à pista original.
Visite este artigo para mais informações sobre o assunto.
Parabéns, agora você sabe mixar uma voz!
Primeiramente, parabéns por ter chegado ao final deste longo artigo! 🙂
Agora você conhece as etapas para realizar a mixagem de uma voz principal, independentemente do estilo musical ou da gravação (mesmo que a qualidade da sua mixagem dependerá, claro, da qualidade da gravação).
Agora, a última etapa é simplesmente colocar em prática: pegue uma mixagem antiga, remova todos os efeitos da pista de voz e comece a mixá-la seguindo as etapas deste artigo.
Depois, faça o mesmo com sua próxima música.
Rapidamente, você notará que suas pistas de canto serão mais impactantes e ocuparão mais seu espaço na mixagem.
Com isso, até breve para outros artigos sobre mixagem de áudio 🙂