混音指南

在家混音怎么做?从零开始的分步入门教程

Seimix 团队 · 约 12 分钟

你录好了人声,beat 也备齐了,vocal 也对上了拍。可整首歌一放出来,总觉得哪里不对劲:人声被 beat 盖住了,低频糊成一团,用手机一听更是散得一塌糊涂。问题不在你的才华,多半出在混音这一步。好消息是:就算没有昂贵的录音棚、动辄上万的监听音箱、也没有做过声学处理的房间,你照样能做出干净、平衡、耐听的混音。

混音本质上是一门讲平衡的手艺。它要做的,就是把手头所有的元素(人声、kick、snare、bass、旋律、效果)在同一时间摆到正确的音量、正确的频段和正确的纵深上。这里没有什么神奇的插件,也没有藏起来的秘诀,有的只是一套清晰的工作流程,和一双有耐心的耳朵。这篇教程要讲的,正是这套流程,一步一步来。

只要你从头到尾照着下面的步骤走,哪怕是你的第一次混音,也能远远甩开'凑合能听'的水平。我会给出具体的数值(切多少 Hz、压多少 dB、推到哪个 LUFS),但别死记硬背,先弄懂每一步在干嘛,再去用。我们开始吧。

什么是混音?它和母带处理有什么区别?

混音和母带处理经常被混为一谈,但这是两件不同的事。混音是处理歌曲内部的一条条单独轨道:把人声、鼓、bass、旋律分别调音量、做 EQ、做压缩,让它们彼此融合。而母带处理是在混音完成、整首歌已经变成一个立体声文件之后,对这首歌整体做的最后润色:整体音色平衡、响度(loudness),以及让它符合各个流媒体平台的要求。

打个简单的比方:混音是把一道菜的各种食材按正确的比例烹好;母带处理则是端上桌前最后的调味和摆盘。这篇教程主要聚焦在混音上,因为一首歌 80% 的质量都是在这里决定的。糟糕的混音,母带处理救不回来。

刚入门时,在脑子里把这两件事分清楚很重要。先把混音做完,在整个混音真正平衡之前,完全不要去操心响度、也别惦记'像广播里那样炸开'。那是最后才管的事。

  • 混音 = 各轨道之间的平衡。母带 = 整首歌最后的抛光。
  • 混音没做完别急着做母带;顺序乱了会返工两遍。
  • 一首歌 80% 的质量在混音阶段定型,把时间花在这里。

先了解你的房间和你的耳朵(房间/耳机的真相)

你听到的有多准,你的每个判断就有多好。如果你听到的东西本身就是错的,那你做的每一个混音决定也都会是错的。在家里,最大的敌人就是房间本身:光秃秃的墙面、玻璃、坚硬的地面会把声音反射回来,尤其在低频上对你的耳朵撒谎。同一段低频,在一个位置听很饱满,往旁边挪两步就没了。这就是所谓的'房间模态(room modes)'在作怪。

解决办法不一定非得买昂贵的声学吸音板。床、厚窗帘、地毯、书架、沙发这些柔软又填得满的表面,能大幅减少反射。音箱别贴着墙放,在它们背后留 20-30 cm 的空隙,并调到与耳朵齐平的高度。条件允许的话,让'音箱—你—音箱'构成一个等边三角形。

用耳机工作也完全没问题,刚入门时甚至是个优势,因为它直接把房间的麻烦排除掉了。但耳机会夸大立体声宽度,也更容易让耳朵疲劳。最关键的一条:用中等音量听。跟说话声差不多,大约 75-85 dB 就够了。开大音量混音会骗过耳朵,让你觉得什么都'挺好'。

  • 用柔软表面(窗帘、地毯、床)压掉反射;不一定非买贵的吸音板。
  • 音箱离墙 20-30 cm,调到耳朵齐平并摆成等边三角形。
  • 用中等音量听(跟说话声差不多);大音量会骗过耳朵。
  • 每 45-60 分钟给耳朵歇 10 分钟;疲劳的耳朵会做出糟糕的判断。

选一首参考曲,对照着它来听

专业人士和你之间最大的差距不是设备,而是对照的习惯。你没法在真空里评判自己的混音;耳朵在 10 分钟内就会对一切习以为常,从而失去对平衡的把握。所以,挑 1-2 首和你风格相同、专业混过的歌,放在手边当参考。

把参考曲作为一条轨道加进工程里,或者准备成能在同一个播放器上快速切换的形式。然后在自己的歌和参考曲之间不停地来回切:'它的人声比我的靠前多少?它的 bass 是不是比我的更干净?高频是不是我这边更刺?'耳朵在对比的时候要诚实得多。

一个重要的陷阱:参考曲已经做过母带,也就是说它更响。人耳会把更响的那个当成'更好'。所以在对比之前,先把参考曲稍微调低,压到和你的歌一样的音量,再去比。否则你会仅仅因为它更响,就总觉得参考曲是对的。

  • 挑 1-2 首同风格、混得好的歌放在手边当参考。
  • 把参考曲调低到和你一样的音量再对比(更响的总被当成'更好')。
  • 不停来回切:问人声够不够靠前、bass 够不够干净、高频会不会太刺。
  • 始终用同一首参考曲;耳朵越熟悉它,你的判断就越清晰。

Gain Staging:让信号从正确的电平起步

混音看不见的地基就是增益分级(gain staging),也就是在还没做任何处理之前,先把每条轨道的电平调到正确的范围。目的有两个:不让任何一条轨道撞到数字天花板(0 dBFS)而失真,同时在混音母线(总输出)上留出能自由呼吸的余量(headroom)。

实用目标:让每条单独轨道最响的瞬间(peak)大约落在 -6 到 -12 dBFS 之间。如果录音本身来得太响,别去动录音,而是把轨道的输入增益(trim/gain)压下来。当你把所有轨道都拉到这样一个合理的基准上,总输出就会留出 -6 dB 左右的余量;这份余量既给效果器留了空间,也给母带处理留了空间。

为什么这很重要?如果信号一开始就太响,你后面串上的 EQ、压缩这些处理,就是在一个已经失真的信号上工作,混音在第一步就被弄脏了。干净进,干净出。所以在放任何效果器之前,先花 5 分钟只调电平,后面能省下好几个小时。

  • 把单轨 peak 控制在 -6 到 -12 dBFS 之间。
  • 来得太响的录音,别用推子(fader)压,用输入增益(trim/gain)压。
  • 总输出留 -6 dB 左右余量(headroom);给效果和母带留出空间。
  • 别让任何一轨亮红(clip);数字失真很难挽回。

先建立粗平衡(只用推子,不加效果)

新手最大的错误,就是一上来就给第一条轨道堆 EQ 和压缩。正确的做法恰恰相反:先不开任何效果,只用音量推子(fader)把整首歌的粗平衡搭出来。听起来难以置信,但一个好混音,一半就是靠正确的推子平衡。

顺序会因风格而异,但在说唱和现代制作里,最重要的两个元素通常是人声和鼓。我建议这样搭:先把 kick 调到一个参考电平,再让 snare 对着它站住,然后把人声推到能在这套鼓之上清晰听见的位置。人声任何时候都要清楚、靠前,因为听众是跟着词走的。最后再把 bass 放到与 kick 协调的位置,把旋律放到不会盖住人声的位置。

在这个阶段,也顺手调一下声像(pan)。人声、kick、snare 和 bass 通常都摆在正中间(mono),因为它们是整首歌的脊梁。而旋律、和声、ad-lib 和效果则可以向左右打开(比如 20%-40%),把声场撑宽。这样中间就不那么拥挤,每个声音都能找到自己的位置。

  • 先不开效果,只用推子搭粗平衡;好混音一半就在这里。
  • 建议顺序:kick → snare → 人声 → bass → 旋律。人声始终清晰靠前。
  • 把脊梁(人声、kick、snare、bass)放中间;装饰性的声音向左右打开。
  • 切成 mono 听;如果在 mono 里都平衡,在立体声里会更棒。

用 EQ 做清理和腾地方

EQ(均衡器)用来切掉或抬升频率。刚入门时,别把 EQ 当成'美化'声音的工具,而要用它来清理、腾地方。逻辑是这样的:每件乐器在频谱上都有自己的位置;如果两个声音在同一段频率里打架,混音就会变糊。你要做的,就是从其中一个身上切掉一点,给另一个腾出地方。

最常用的两个动作:第一,清掉多余的低频。给人声、吉他、旋律这些本来就没有低音的声音,加一个大约从 80-100 Hz 往下切的 high-pass(高通)滤波器;只有 kick 和 bass 才真正需要那些实打实的低频。光是这一个动作,就能让混音变清晰。第二,检查一下 200-400 Hz 这个'浑浊'区;人声和很多声音都会在这里堆积,出现闷糊的音色,用一个窄频带切 2-4 dB 就能透气。

抬升(boost)要克制。给人声在 10-12 kHz 加一个 1-2 dB 的、柔和的搁架式抬升,能带来空气感和明亮度,很好听。如果人声的'身体感'偏弱,可以在 150-250 Hz 给一点小小的补充。黄金法则:先切,需要的话再轻轻抬。而且一定要用'bypass'来回开关,确认它到底有没有真的变好;耳朵会骗人。

  • 给没有低音的声音在 80-100 Hz 加 high-pass;只给 kick 和 bass 留低频。
  • 针对浑浊,在 200-400 Hz 用窄频带切 2-4 dB;闷糊就散开了。
  • 给人声加空气感,试试在 10-12 kHz 做 1-2 dB 柔和的搁架抬升。
  • 少用 boost,先切;每个动作都用 bypass 来回开关来验证。

用压缩获得稳定感

压缩器会压住声音最响的瞬间,把它和最轻部分之间的差距拉近;也就是缩小动态范围。结果就是:人声在一句话的开头和结尾都同样清晰、靠前、稳定。那些原本听不清的字,被压缩安放回了原位。但压过头会让声音变得'喘不上气'、发闷,所以要有分寸地用。

主要的几个参数是这样的:Ratio(压缩比)决定压得多狠;对人声来说,3:1 到 4:1 是个不错的起点。Threshold(阈值)决定声音从哪个电平开始被压;调到让最响的瞬间大约有 3-6 dB 的衰减(gain reduction)。Attack(启动时间)保持在中等值(10-30 ms),字头的冲击力就能保住;attack 太快会让声音发死。Release(释放)则根据声音自然的呼吸调到中等。

你可以按风格来选压缩的性格:又快又猛的压缩(FET 式快速压缩器)能增强说唱人声的靠前感和抓地力;柔和又有音乐性的压缩(光电式压缩器)在旋律性人声上更自然。而在鼓组和总输出上,一个温和的 VCA 式母线压缩(2:1,只压 1-2 dB)能把各个部分'粘'在一起,让混音更整体。刚入门时不必给每条轨道都加压缩;受益最大的是人声和鼓。

  • 人声用 3:1-4:1 压缩比、3-6 dB 衰减(gain reduction)是个好起点。
  • Attack 保持中等(10-30 ms),别让字头的冲击力和能量丢掉。
  • 说唱人声试快/猛的压缩,旋律性人声试柔和/光电式的压缩。
  • 给总输出加温和的母线压缩(2:1,1-2 dB),把混音粘到一起。

混响、延迟和纵深

到目前为止我们把声音清理干净、也调平衡了;现在该给混音加入纵深和情绪了。混响(reverb,回声/空间感)和延迟(delay,回音/重复)能把声音安放到一个空间里。目的不是把声音'泡湿',而是把听众放进一个房间或一个舞台里。少一点效果永远好过多一点效果;刚入门时,大家的通病就是在这里加得太过。

混响要用一条单独的'send'轨道来做;也就是说,别给每个声音单独挂混响,而是建一条混响轨,再从各个声音往它上面分配发送量。为了让人声保持清晰,短到中等的板式混响(plate)很不错:decay(衰减)0.8-1.5 秒,pre-delay 20-40 ms。pre-delay 会在声音干的起始和它的回声之间留一小段空隙;这样字仍然清晰,但背后有了空间感。混响量要压到这种程度:关掉时你会觉得'少了点什么',但开着时又察觉不到它的存在。

延迟一旦踩进节奏里,就会变得很神奇。一个和歌曲速度同步(比如 1/8 或 1/4 音符)的延迟,能给说唱的 ad-lib 和副歌人声填进能量和空隙。为了不让人声变糊,可以给延迟的重复声也加一点轻微的 high-pass(切掉 300 Hz 以下),以保持干净。规则很简单:效果是调料,不是主菜。

  • 混响用单独的 send 轨给;别给每条轨道单独挂混响。
  • 人声用短到中等的板式混响:decay 0.8-1.5 秒,pre-delay 20-40 ms。
  • 延迟跟速度同步(1/8 或 1/4 音符);切掉重复声的低频保持干净。
  • 效果量压到:关掉能感到缺失、开着又察觉不到的程度。

给人声和说唱的额外处理

这篇教程的读者很大一部分都在跟人声和说唱打交道,所以给人声几条专门的提醒。第一是高频里的's'、'sh'、't'音:随着压缩加重、明亮度提高,这些音会发出'咝咝'声,让耳朵不舒服。这叫'齿音(sibilance)'。它的解决办法是一个叫 de-esser 的工具,专门下到那段咝咝声的频带上把它压住;通常工作在 6-9 kHz 区间。de-esser 要放在 EQ 和压缩之后,也就是效果链的靠后位置。

音高修正(autotune)是现代人声的一部分。透明地用,它只修正跑调的音,谁也听不出来;调得狠了,就给出那种大家熟悉的机器人/trap 味效果。怎么选取决于你的审美,但有一条规则:先尽可能把录音唱得干净、唱准,把音高修正当成润色,而不是救命稻草。如果你没把歌曲的调(key)正确地填进软件,修正会把音往错的音上拉。

最后是人声叠层。把副歌人声加倍(double)、轻轻向左右打开,能把副歌'撑大';把 ad-lib 从主人声压低几个 dB 再向两侧铺开,声场就满了,但主词仍然靠前。加叠层的时候要不停地问:'主词是不是还最清楚?'

  • 处理咝咝的's/sh'音,把 de-esser 放在 6-9 kHz、效果链的最后。
  • 把 autotune 当润色而非救命稻草;先把录音唱准,把 key 填对。
  • 副歌人声加倍向两侧打开,ad-lib 压低铺开;主词永远靠前。
  • 把人声组归到一条轨(bus)上一起调,会让活儿轻松很多。

手机—汽车检查与正确的响度

混音真正的考验不在录音室耳机上,而在这首歌将要被播放的地方:手机扬声器、蓝牙音箱、汽车、廉价耳机、笔记本电脑。这些设备里大多几乎没有低频,中频反而突出。混音只在昂贵系统上好听、在手机上糟糕透顶,是一个非常常见的错误;因为所有判断都只在一套系统上做出的。

所以在收尾混音之前,用你的手机、汽车和笔记本扬声器都听一遍。人声在小扬声器上也听得清吗?低频消失之后,歌是空了,还是仍然有能量?300-500 Hz 附近中频所承载的'身体感'很重要,因为小扬声器推不出低频,却能推出这段中频;让你的 kick 和 bass 在那里也有一个抓手。另外按一下 mono 键听一听:如果在 mono 里各个部分消失了,那说明你有相位问题。

最后才轮到响度(loudness)。流媒体平台会按一个固定目标自动调整歌曲的音量;常见的参考大约是 -14 LUFS。如果你把 true peak(真实峰值)控制在 -1 dBTP 以下,就不会在平台压缩时出现失真。别为了'不比对手小声'就往限制器上猛怼、把歌压死;一个过响、压扁的混音,永远比一个平衡但稍微安静一点的混音更糟。平衡和清晰,比原始的响度更有价值。

把上面这些步骤(gain staging、平衡、EQ、压缩、效果、响度)按正确的顺序、用正确的数值做下来,出来的就是一份专业的作品。但要在每一首歌上都把这一切一个个手动做完,需要相当的时间和经验。如果你只想专心搞音乐,把混音这块技术负担交给自动化,Seimix 正是为此而生:上传你的分轨,选好参考曲,几分钟内就能拿到一份平衡、可发行的混音。想学的人就动手学,想快点交活的人就交给自动化;两者背后,都是这篇教程里同一套逻辑。

  • 混音一定要用手机、汽车和笔记本扬声器听;判断不能只在一套系统上做。
  • 为小扬声器保住 300-500 Hz 的中频'身体感';让 bass 从那里也抓得住。
  • 按下 mono 键;如果各部分消失了,那就是有相位问题。
  • 目标约 -14 LUFS,true peak 在 -1 dBTP 以下;别压死,留住平衡。

不想手动处理?

把你的音轨上传到 Seimix,选一个预设或直接说出你的需求——几分钟内拿到混音好的文件。7 天免费试用。

常见问题

在家做好混音必须要哪些设备?

说来意外,其实很少。一台电脑、一个混音软件(DAW)和一副像样的耳机,入门就够了。昂贵的监听音箱、声卡和做过声学处理的房间能让事情更轻松,但都不是非有不可。比起设备,正确的工作流程和对照式聆听(参考曲)才是拉开差距的关键。在房间里放上窗帘、地毯、床这些柔软表面,往往比大多数昂贵的升级都更管用。

只用耳机能做出好混音吗?

能。事实上,在一个声学很差的房间里,耳机可能比音箱更可靠,因为它把房间反射排除在外了。要注意的是:耳机可能把立体声宽度和低频显示得和实际不一样,也容易让耳朵很快疲劳。所以要用中等音量听、勤休息,并且一定要用手机、笔记本、汽车这些不同的地方检查混音。别只在一副耳机上下判断。

混音和母带处理有什么区别?

混音是处理歌曲内部的一条条单独轨道(人声、鼓、bass、旋律),让它们彼此平衡。而母带处理是在混音完成、整首歌变成一个立体声文件之后,对整首歌做的最后抛光和响度调整。先把混音彻底做完,再进母带。糟糕的混音,母带救不回来;歌曲质量的绝大部分是在混音阶段决定的。

我的人声被 beat 盖住了,该怎么办?

通常有三个原因。第一是音量:在粗平衡里,你没把人声推到能在鼓之上清晰听见的程度。第二是频率打架:旋律和人声在 200-400 Hz 的浑浊区里互相挤,从其中一个切 2-4 dB 腾出地方。第三是动态:人声在句子里忽高忽低,用 3:1-4:1 的比例做轻微压缩(3-6 dB 衰减)来获得稳定感。另外给人声在 10-12 kHz 加一点空气感/明亮度,也能增强靠前感。

我的歌在手机上为什么又小声又难听?

因为手机扬声器几乎推不出低频,反而把中频往前顶。如果你只在一套低频很足的系统上听并做判断,到手机上那个平衡就崩了。解决办法:让 kick 和 bass 在 300-500 Hz 附近也有一个抓手,把人声在中频保持清晰,并且一定要用手机检查混音。另外,一味追求响度、把歌压死,在小扬声器上也会出坏结果;留住平衡。

参考曲该怎么选、怎么用?

选 1-2 首和你风格相同、专业混过、你喜欢它音色的歌。把它加进工程里,或准备成能快速切换的形式,和自己的混音不停来回切着对比:人声多靠前、bass 多干净、高频多通透。一个重要的细节:参考曲因为做过母带,所以更响;对比之前先把它压到和你一样的音量,否则你会仅仅因为它更响,就总觉得它是对的。

学会混音要多久?

一个基本的平衡,几天之内就能抓住;但耳朵真正练到位,是要花上好几个月的功夫。进步最快的路,就是每首歌都重复这篇教程里的顺序(gain staging、平衡、EQ、压缩、效果、检查),再把结果和参考曲对比。对于学习时不想浪费时间、或者想要快速稳定结果的人,自动混音工具(比如 Seimix)能在几分钟内应用同一套逻辑;学习和自动化也完全可以并行使用。

本指南的其他语言版本

更多: 全部指南