尧图网站设计 尧图网站设计YAOTU DESIGN
ARTICLE DETAIL

资讯详情

深耕网站设计与一线实操的经验洞察。

音频后期处理全解析:从干声到成品的五站式流程

音频后期处理全解析:从干声到成品的五站式流程 不管你是管录音的、剪视频的、做游戏的还是跟我那位外号莫提斯的朋友一样纯粹被音频美术这四个字搞得一头雾水——这篇就是给你写的。莫提斯本人有个挺让人抓狂的特点他分不清压缩器和压缩包觉得混响就是回声开大点他第一次打开DAW的时候愣是问我这玩意儿跟剪辑软件长得差不多那我剪视频为啥还要找你。但就是这样一个纯外行在我给他捋完一遍流程之后居然也能一个人把一段干巴巴的录音处理得像模像样。我想了想不是他天赋异禀而是音频后期这件事本身就有清晰的流程和逻辑只要有人把顺序讲明白谁都能上手。所以这篇文章不讲玄学不堆那些看一眼就想关掉的理论名词就按一条声音素材从进电脑到变成最终成品到底要经过哪些工序、每道工序在干嘛、为什么非要这么干全都拆开揉碎讲清楚。1. 先搞明白音频美术不是顺手加个滤镜它是一条完整的流水线我见过太多人拿着手机录音直接丢进剪辑软件觉得音频后期就是声音小了大点声声音大了小点声。你要是这么理解那后面所有工序对你来说都是多余的。音频美术这个概念往大说包括声音设计、录音整理、后期混音、母带处理往小说就是你在游戏、影视、短视频里听到的每一耳朵声音凡是听起来不像原生态的部分基本都属于这摊活。它的本质跟画画、跟视频调色是一回事给原始声音素材做造型和上色让它在情绪、清晰度、空间感上都达到你想要的效果。打个比方你录了一段人声干音那就是一块没有调味的生肉。音频后期不是让你弄熟而是让你决定它是红烧还是清蒸火候在哪加什么佐料上桌时候是什么气质。大叔音可以变得更沧桑少女音可以变得更清亮这都靠后期不是靠重新录音。所以你得有一个心理建设音频美术不是一步到位的操作而是一条流水线。每条声音从头走到尾一定会经过几个固定环节——修整、动态、频率、空间、响度。顺序可能会因为素材类型微调但整体框架不会变。你把这条流水线记在脑子里后面不管遇到什么活儿都不会慌。1.1 先分清几个角色编曲、混音、母带不是一回事很多小白喜欢混着叫你不是搞音乐的吗帮我写个曲呗。这就好比看到IT的就说会修冰箱。音频美术相关流程里三个角色分工明确编曲/作曲负责有没有的问题决定什么乐器弹什么音符这是创作端。混音负责怎么摆的问题把已经有的各个音轨人声、吉他、鼓、合成器放在一起调整音量比例、频率避让、空间关系让它像一个整体乐队在你面前演。这是音频美术的重头戏。母带负责怎么发的问题把混音完成的立体声成品再统一做一轮响度、频率和动态优化让它在手机、汽车音响、大喇叭上都能听且和别的平台歌曲音量一致。对于大多数做视频、做游戏、做播客的朋友你可能需要重点掌握的是混音这层的思维但流程上下游你也得知道不然别人和你说响度不够的时候你连矛头该指向哪都没数。1.2 这个时代做音频的门槛比你想得低得多我这些年最大的感受是软件和硬件的门槛已经低到几乎等于没有。以前做混音要个大调音台、一个独立声学棚现在一台还凑合的电脑加一副不差的耳机就能开工。工具不是瓶颈逻辑才是。所以别被专业两个字吓退。莫提斯那家伙连乐理都不懂照样能在我指导下完成一条语音的后期处理因为流程是固定的打开软件导入素材按步骤处理导出。你需要学的不是每一个旋钮背后的物理学原理而是这一步我要解决什么问题用哪个工具大概调到什么范围。2. 开工前的准备软件、耳机和你最容易忽视的耳朵在进流程之前先花点篇幅聊聊工具。很多新手最容易犯的毛病就是疯狂买设备手机录音还没录明白就琢磨着上万的麦克风。音频美术这个行当对你作品质量起决定作用的排在第一位的是你的耳朵和审美第二位是素材本身质量第三位才是软件和硬件。2.1 DAW到底选哪个我的建议和理由DAW数字音频工作站就是你的主战场。市面上能选的一大堆但我给新手划个范围软件适用人群特点价格REAPER视频作者、播客、功能党极其轻量启动快功能全自定义强约450元评测期无限用Studio One新手友好、离不开可视化拖拽逻辑顺手自带音源丰富上手弧线平滑分版本入门版很便宜Audition做视频、做语音处理单轨修复能力强和Adobe生态无缝衔接订阅制稍贵Pro Tools录音棚、专业混音行业标准但学习曲线陡、启动慢贵订阅制FL Studio做电子音乐、编曲编曲逻辑天才但混音窗口小众一次买断我个人给新手的推荐是如果你主要做视频或播客Reaper或者Audition都行前者性价比高后者对单段音频的降噪、修复处理更友好。如果你以后想写歌、编曲、正经做混音Studio One或者FL Studio会更顺畅。别在选软件上反复纠结随便挑一个用三个月比什么都强。2.2 耳机和音箱先买密闭式监听耳机别急着上音箱很多新手第一次开口就问我要买什么监听音箱这是个大坑。监听音箱对房间声学的依赖极大。你把音箱放在一个普通卧室里墙角反射、桌面共振会让你听到的声音和真实声音完全不是一回事。在没做声学装修之前花大价钱买音箱听到的全是房间给你的错误信息你做出来的混响、低频可能全偏了。我建议第一步先投入一副密闭式监听耳机比如常见的型号在几百到两千这个区间都有不少选择。它的好处是不挑房间、不漏音、售价相对可控而且在新手阶段戴着耳机做后期能让你集中精力听细节。等你有独立工作室环境了再考虑音箱也不迟。别迷信耳机越贵越好的说法。新手阶段的瓶颈极少是设备解析力不够而是耳朵不知道往哪儿听。用听歌用的普通耳机能不能做说实话能。但密闭式监听耳机声音更中正不会刻意美化低频或高频你做出来的东西在别处播放才不容易走样。2.3 最容易被忽略的准备练耳朵比练手更优先我承认这个说法有点虚但它是真的有用。所谓练耳朵就是建立参照系。你得知道什么是好的底噪、什么是干净的齿音、什么是舒服的空间感。方法很简单每天拿一两首你觉得混音很牛的商业歌曲放进你的DAW戴上耳机一首歌拆开听只听人声在什么位置鼓在什么位置低频贝斯有多大人声上加的混响是长是短。听几天你的耳朵就开始有了维度。莫提斯当时最搞笑的问题就是混响是啥我听不出来。我说没关系你先找首歌把它的混响想象成你跑到浴室唱歌时听到的那种尾巴音然后闭眼听。两天之后他跟我说我听出来了原来人是站在一个大厅里。一旦你有了这种感知后面所有调节参数的动作才有意义。这就是为什么我说耳朵的准备工作排第一。3. 一条声音从素材到成品的完整旅程核心处理链路现在进入正题。假设你手里有一段刚录好的人声干音或者一段从音效库下载的脚步声它要经历哪几站才能进入成片我每次给新手讲流程都喜欢用流水线这个比喻因为音频处理真的是一步一步递进的后一步的结果取决于前一步的底子。你如果跳步或者反过来后期会越做越乱。3.1 第一站修整——把素材弄干净、弄对齐这一站干三件事降噪、去冗余、对节奏。降噪是很多人最关心的。录音环境总有底噪、电流声、空调声甚至窗外的车流。处理思路有两种一种是采样降噪截取一段没有人声的纯底噪让软件学习这个底噪的特征然后从整段里把它去掉。这种降噪适合平稳的底噪但降过头会让声音发闷、产生水声。另一种是动态门限设置一个电平阈值低于阈值的部分自动静音适合处理只在空白处有明显的噪音的情况。去冗余很简单就是把录音里的吸气声、喷麦声、不自然的停顿、口误、鼠标点击声修剪掉。很多人以为这步不重要但你随便听听网上那些业余播客那些吧唧嘴大喘气不断的声音全是因为没有修自己的干音。这步不需要任何插件就在编辑器里像剪视频一样把波形剪开删掉就行。对节奏指的是如果这段人声要配到特定画面上或者要和其他乐句对齐你需要把它拉到正确的时间位置。现代DAW都有弹性音频功能你可以拖动音频块、微调时值让语音和小节线对齐。3.2 第二站动态——控制声音的性格起伏一个人唱歌或说话的时候音量不是恒定的。情绪激动时音量大尾句时音量小。这会导致你把它和其他音乐放在一起时忽大忽小听感很差。动态处理就是干这个的。最核心的工具是压缩器。它的工作原理说白了就是设定一个阈值当信号超过阈值时自动把超出的部分按比例减小当信号回落时再按设定恢复。这里出现四个常见参数新手一听就头大我一个个说人话阈值Threshold从哪个音量开始压缩。数字越低被压缩的部分越多。压缩比Ratio超过阈值之后每多出多少分贝才允许通过。2:1 表示超出2dB只放行1dB比例越大钳制越狠。启动时间Attack检测到超阈值后反应多快才开始压。快启动适合控制瞬态比如鼓点慢启动适合让人声保持自然的前音。释放时间Release信号回落后松手多快。太快会忽明忽暗太慢会让声音一直软绵绵。你用压缩器不是要把声音压成一条平线而是让它稳但不死。人声常用起始值是阈值-18dB左右比例2:1到3:1启动10ms上下释放100ms附近然后靠耳朵微调。至于为什么这么设因为人声的动态起伏不像鼓那么暴烈太快的启动会把字头的力度吃掉声音就变闷头闷脑了。3.3 第三站频率——给不同频段让路这步用到的是均衡器EQ。说白了你把一个声音拆成低、中、高三段来听低频20-250Hz左右决定力度和厚度。但人声里太多低频会浑浊乐器里太多低频会糊成一片。中频250Hz-4kHz左右决定清晰度和存在感。人声的辨识度基本都在这个区域。高频4kHz以上决定空气感和亮度。太多会刺耳尤其齿音太少会闷。EQ不是什么玄学它处理的核心逻辑就是避让和刻画。避让的意思是当人声和背景音乐打架时不能两个都拧到最大而是给背景音乐减一点中频让人声在中频区有自己清晰的位置。刻画的意思是根据素材本身的问题衰减某个刺耳的频段或者提升一点让人声透亮的高频。怎么快速找到要处理的频点用扫频法在EQ上选一个较小的Q值就是带宽比较窄把增益拉到很大然后慢慢上下移动频率当某个频点让你觉得特别难受、特别刺耳或者特别浑浊时就找到了问题点再把它衰减3-6dB。这个过程很直观你试一次就记住了。3.4 第四站空间——在不存在的房间里放上声音没有空间感的声音是干的就像演员站在纯白背景前。混响和延迟就是给声音搭建场景。混响的本质是无数个反射声的叠加它让你感觉声音发生在某个大小的房间里。区别只是教堂的大混响和卫生间的短混响。新手最常见的问题是混响量开太大导致声音糊在一起。一个可靠的思路是先把混响开到你能明显听到叠音的程度然后往回退退到好像有空间、但听不出是混响的位置再多退一点点。这是绝大多数人声的舒适区。延迟和混响不一样延迟是明确的一个回声。它更多用来制造节奏感或立体感比如给副歌的人声加一个极短时间的延迟可以让人声显得更宽。但在播客和视频语音里延迟用得很少因为会破坏清晰度。3.5 第五站平衡、自动化与导出最后一步是整体的平衡调整。把所有人声、背景音乐、环境声按照主次关系定好音量然后该做自动化的地方做自动化。自动化这个词听着高级其实就是让某个参数随时间变化。比如副歌开始时背景音乐稍微降低一点、人声稍微推亮一点这些都是画参数线实现的。到了导出环节新手最关心的往往不是格式而是响度。响度当然重要但它不是越高越好。现在的流媒体平台短视频、视频网站会统一响度标准你如果把素材输出得特别响反而容易被平台压回标准值还多一道损伤。所以导出时人声处理保证整体响度在合理范围内比如对人声为主的视频响度控制在-16 LUFS上下比盲目追求大声要安全得多。4. 实操拆解给一段干巴巴的人声变成有质感的成品理论说了那么多我带你实操一把。假设莫提斯录了一段语音旁白录的时候离麦克风40厘米环境有点底噪语速平稳但情绪平淡。目标做成一段干净、清晰、有亲和力的旁白。4.1 导入和初修十分钟搞定地基第一件事是把素材导入DAW先听一遍。你会发现有两个问题有电流底噪开头和句尾有呼吸声。第二步操作先把没人声的空白区域裁掉或静音再把波形放大把明显的呼吸声剪出来调低它的音量而不是直接删除。为什么不删因为完全无声的停顿在某些时候比保留一点呼吸更不自然。保留微弱的呼吸人听起来反而真实。然后是降噪。我更喜欢用采样降噪选中一段只有底噪的部分让软件学习然后应用到整段。降噪强度控制在10-20%之间不要追求把底噪消除到零。为什么因为降噪算法本质上是在减信息降太多人声就会像隔了一层纸一样发闷。做完全部处理后别急着进行下一步闭眼听十秒确认没有明显的水声或金属感。4.2 动态和频率让声音稳且有亲和力修干净之后我通常先插一个压缩器。参数从阈值-20dB、比例2.5:1、启动10ms、释放150ms起步然后边播放边调到干声最低音和最激动处的音量差距缩小到能接受的程度。这里听感是唯一的标尺。如果你发现字头被压掉了、声音发闷把启动时间调到20ms以上。清完动态之后加一个EQ。给旁白人声一个常见的处理起点频段处理动作目的50-80Hz高通滤波砍掉以下去除房间低频轰鸣和喷麦声200-400Hz如果感觉闷衰减2-3dB让声音更通透4000-6000Hz衰减刺耳频点控制齿音和嘶声10000-12000Hz轻提2dB增加空气感显得更亲近这里要反复强调EQ不是公式不是每个素材都照抄。上面的值只是起点你调完一定要来回切换处理前/处理后对比直到觉得变化是变好了而不是变怪了。4.3 空间和亮度用一点点混响骗过耳朵旁白人声的处理原则是像在你耳边说话不要像站在教堂里念稿。所以混响要非常克制。我一般用一个短混响预延迟20ms左右混响时间0.8-1.2秒干湿比控制在10-15%以内。调完之后把伴奏或其他声音关掉单独听人声你应该能感觉到一点空气感但听不出明显的回声。如果你能清楚听到余音绕梁说明加多了退回去。为了让声音更有亲和力还可以在人声上加一点轻微的饱和器它本质上是给声音增加一点谐波让干瘪的声音多出一点润度。这个操作不用懂原理直接上插件调低强度直到人声稍微变暖一点就停。没有饱和器就用EQ提一点点低频和高频也能达到类似效果。4.4 对轨和自动化让整体有起伏旁白一般不需要太多节奏对齐但如果视频里有画面切换、关键词强调就需要做自动化了。比如在某个关键词出现前把音量往上推1-2dB或者让背景音乐下降一些。这些变化要平缓不要画成突兀的台阶。全部处理完你做一个终混试听放到手机外放上听一次放到耳机里听一次。手机外放能检查清晰度和低频是否过多耳机能检查细节。如果两处都听着舒服你这单活就算完成得相当不错了。5. 新手最容易踩的五个坑还有我的处理办法写到这里我想起自己刚入行时踩的坑以及后来帮包括莫提斯在内的一堆朋友擦屁股的经历。下面这几个问题绝对是你早晚会碰见的。5.1 坑一混响叠太多声音糊成一锅粥几乎每个新手拿到混响都会忍不住拧High。我当时也一样觉得加了混响就专业了结果人声退到背景里歌词根本听不清。这个坑的根源是你把空间感理解成了音效。解决办法很简单加混响的时候先把效果调到很夸张、很难听再退回来三分之一直到你觉得刚刚好的时候再多退一档。佐证标准是你仍然能听清每一个字且听不出处理痕迹。5.2 坑二压缩当音量放大用越压越死新手容易觉得压缩能让声音变大所以使劲把阈值往下拉、比例往上调。结果人声是稳了但完全没有动态平淡得像在念经。压缩器不是音量放大器它是控制音量波动的。如果你在K歌或者后期时发现声音不自然十有八九是压缩过头了。建议把比例降到2:1以内听一听变化少但更自然是不是你更想要的效果。5.3 坑三没有参照凭感觉瞎调我在野路子的阶段特别喜欢跟着感觉走觉得高频少了就加高频觉得低频乱了就砍低频结果越调越乱。后来我养成了一个习惯每做一步调整都和原声或者市面上的商业成品做一个AB对比。你不需要凭空知道什么是对的你只需要找到参考再往那个方向靠。这个方法尤其适合新手因为你缺的其实不是技巧而是参照系。5.4 坑四导出响度开太大反而被平台压伤以前我为了让自己做的音乐在手机里听起来不小声导出时把响度推到快顶格的-8 LUFS。结果发到流媒体上平台自动帮他降回-14 LUFS声音不仅没更响反而因为限压失真变得又破又闷。后来才明白枪打出头鸟平台上响度太高反而挨砍。做视频声音、播客建议把人声为主的整体响度控制在-16到-14 LUFS。响度是听起来多响不是波形多高你用响度表插件看。5.5 坑五只在耳机里听没检查其他设备你戴着监听耳机觉得平衡感极好一导出到手机外放低频哐哐响人声快被盖完了。这种情况太常见了。原因是耳机和手机外放的频率响应完全不同而且耳机有左右声道分离手机外放往往只有一个单声道喇叭。所以导出之前请一定做两个检查一是用单声道模式听一遍确认人声和音乐在一起时不会互相抵消或混成一团二是用手机外放播一遍确认整个平衡没偏太多。6. 不同场景下的音频美术侧重点视频、游戏、音乐各有各的道同样是音频美术在不同载体里画的重点画布完全不同。有些人做视频做惯了一转行做游戏还按视频那套来结果被玩家骂声音没交互感。这里简单聊聊三条分支6.1 短视频、播客、视频旁白清晰度就是命这种场景的核心目标只有一个让人听清楚在说什么。技巧顺序是先修冗余比如剪掉口水声、再做动态稳定、EQ上保证人声中频突出、最后加一点点空间来润色。背景音乐永远是配角响度必须压在人声下面。我常跟做视频的朋友说人声就是画面里的主角BGM就是背景板背景板再漂亮也不能抢戏。6.2 游戏音频声音要有反馈感游戏音频讲究的是互动。UI点击声、角色脚步声、环境音景、音效触发每一个都极短、极精准。它不需要长时间的混音连贯性但需要每个音效在不同场景下都有对应的行为。比如脚步踩在地板上、草地上、雪地上声音质感要有明显变化音量还要根据距离衰减。处理上除了常规的EQ和压缩还要注意音效之间的频率不打架不然多个音效同时触发时玩家听到的就是一锅乱糊。6.3 音乐混音艺术表达优先响度也要顶音乐混音比语音处理复杂得多因为要同时处理几十条音轨。这时候流程就更讲究顺序了先修鼓和贝斯的低频基础再修人声和其他旋律的中高频然后做分组平衡最后到总线上统一做压缩和限幅。音乐混音中空间感的分配极重要——不是所有乐器都要加混响而是给某些乐器家里大空间某些乐器怼脸大特写形成纵深层次。新手如果一上来就想做音乐混音建议先把单条人声的流程练透别一步登天。7. 我的个人流程速查表莫提斯看完就能动手的第一版最后我把完整的流程压成一张可以直接照着做的清单。你完全可以把它当成菜谱每次处理声音时按顺序走一遍用熟了再增加变化导入素材通听一遍标记出底噪、呼吸声、爆音、口误。修剪波形删冗余、把明显噪音处静音、保留微弱呼吸感。采样降噪或动态门限处理底噪强度宁小勿大。压缩器阈值-20dB起、比例2:1到3:1、启动10-20ms、释放100-150ms让人声整体稳定。均衡器高通到50-80Hz找刺耳频点衰减必要时提升高频空气感。混响和延迟先旁通、再调到刚刚好、再多退一步。对照参考曲AB对比确认方向没错。做平衡和自动化人声为主体BGM让路关键词突出一丢丢。响度表确认整体在-16到-14 LUFS左右播放前用手机外放和耳机各听一遍。导出无损格式WAV再按平台要求转成MP4/AAC等。这个清单里没有一步需要你懂高深理论你只需要知道每步解决什么问题、大概什么参数范围、什么听感算是对的。剩下的就是积累。我个人的经验是整个流程跑十遍你基本就能摆脱对参数的依赖开始凭感觉去判断了。而且你会慢慢发现音频美术最有魅力的地方恰恰在于它是百分之五十的技术加百分之五十的感知——当你有一天调完一段声音觉得这就是我想要的样子时那种成就感跟画完一幅画、剪完一支片是相通的。莫提斯现在已经能独立给视频做完整的音频后期了。他甚至开始在游戏音效里搞各种奇奇怪怪的声音设计。他说以前觉得音频美术像另一门语言现在发现它不过是一条早已存在的流水线旁边挂着一堆帮你完成工作的工具你要做的只是熟悉每个工具的脾气而已。文末补一句给新手的真心话别怕设备普通别怕调得不好把自己手上的素材一遍遍地过耳朵会越来越灵判断会越来越准。音频这行没有什么天才速成有的全是多听、多看、多动手之后慢慢变成直觉的东西。你开始跑了就比昨天那个在软件前发呆的你强一大截。
返回列表