录制游戏视频时,声音不稳是最令人头疼的问题之一。前一秒解说还中气十足,后一秒就变得含混不清,观众只能频繁调整音量,体验大打折扣。这种问题通常不在游戏本身,而在于录音链路和后期处理环节。
一个容易被忽略的是麦克风距离。游戏主播习惯侧头看屏幕,或者激动时身体前倾后仰,麦克风与嘴部距离随之变化。声音强度遵循平方反比定律,距离拉近一半,音量大约增加6分贝,远离一倍则减少6分贝。而实际中,头部移动十几厘米,音量差可能超过10分贝。人耳对3分贝的变化就明显感知,10分贝已经是一倍响度的差距,所以忽大忽小十分明显。解决办法是固定拾音距离,比如使用支架让话筒始终在嘴前10到15厘米处,同时注意坐姿,减少大幅移动。
还有一个常见来源是自动增益控制,也就是AGC。很多麦克风和声卡默认开启这个功能,目的让音量自动保持恒定,但它反应跟不上游戏解说的节奏。当人声突然提高时,AGC会快速压低增益,声音瞬间闷住,而喊完后它又慢慢恢复,形成泵感,回放时听感很差。在声卡驱动中关闭AGC,改为手动设定增益,让输入电平峰值保持在负3到负6分贝FS之间,留出余量,避免削波。如果找不到选项,可以在操作系统的录音设备属性中关闭“允许应用程序独占控制”,再检查增强选项卡里的“自动增益控制”是否勾选。
即使关掉AGC,人声本身的动态范围依然很大。平时说话时,强调词和尾音之间音量差可达20到30分贝,这是语言特点,直接录出就是忽大忽小。要解决,必须用压缩器。压缩器像一个自动音量管理员,超过阈值的电平按比例减小增益,低于阈值则基本放任。对于游戏解说,常用设置为阈值负18分贝FS,压缩比3比1,启动时间5毫秒,释放时间100毫秒。这样能压住突然爆发音,又不会让尾音干瘪。后面可再串联一个限制器,把输出峰值限制在负1分贝FS,防止瞬时过载爆音。若人声仍不稳,可尝试多段压缩,把低频部分的动态单独处理,但新手慎用。
游戏音效与背景音乐也是主要干扰。很多游戏在爆炸、枪击或多人语音时音量突然增大,如果录制成混合音轨,整个声音就会跟着游戏音效波动。理想做法是分开录音,游戏声音由声卡播放,人声独立录制,后期再混。条件不允许的,录制时把游戏主音量调低,让人声占主导,后期用均衡器把游戏音效中与人声重叠的频率稍微衰减。还可以在游戏音频设置中打开“动态范围压缩”选项,不少游戏自带这个功能,能够缩小音效音量波动,让爆炸声和脚步声不至于相差太远。

后期处理同样关键。在剪辑软件中,对人声轨应用响度标准化,比如目标值设为负14 LUFS,这是流媒体平台常用参考。但标准化只是整体音量调节,