立项阶段就要确定人声的优先级等级

商业视频的声音混音重点是在立项阶段就要明确人声在整条片子中的位置。品牌方需要先回答一个问题,这条视频的核心信息是靠人声传递,还是靠画面和音乐传递。如果核心卖点是产品参数、服务承诺或创始人观点,人声必须排在第一位。如果核心是氛围、情绪或视觉冲击,人声可能只是辅助。这个判断决定了后续所有声音工作的预算和工期分配。

案例资料中的商业视频制作画面,观察镜头、主体与光线关系
案例资料截帧,来源于研究资料《How one VFX artist made these 3 minutes of madness》。该画面仅用于观察镜头与制作方法,不代表 ONCE 客户项目。 来源页面 案例资料页

具体动作是,在项目brief里写清楚人声的用途,是解说、对白、采访还是旁白。同时要标注出哪些段落的人声绝对不能丢,哪些段落可以接受被音乐或音效覆盖。制作团队拿到brief后,要回传一份声音优先级清单,列出每个场景的人声类型、录制方式、预期混音比例。品牌方要确认这份清单,而不是等到样片出来再提意见。

风险在于,如果立项阶段没有明确优先级,后期混音时就会出现反复调整,音乐压人声、人声压音乐,最后交付的版本可能两边都不满意。例外情况是,有些视频本身就是纯音乐或纯音效,不需要人声,那就不适用这个优先级设置。判断标准很简单,只要片子中有人声出现,就必须在立项阶段确定它的优先级。

拍摄阶段为后期人声预留干净素材

人声优先级的实现,一半靠拍摄时录到干净的声音。商业视频拍摄中,现场环境复杂,空调声、交通声、工作人员走动声都会成为后期混音的干扰。拍摄团队要在开机前做声音检查,用监听耳机听一遍现场底噪,记录噪声源并尽可能消除。如果无法消除,就要调整收音位置或更换录制时间。

具体动作是,每个有对白或采访的镜头,都要单独录制一条高质量的声音轨道,和画面同步记录。同时要录一条环境声,长度不少于三十秒,用于后期填补空隙。录音设备要远离电源变压器和荧光灯,话筒要放在演员嘴部前方十五到三十厘米的位置,避开呼吸声和喷麦。如果现场有多个声源,要分轨录制,不要混成一条。

风险在于,很多项目为了赶进度,只依赖机头麦克风或相机内置录音,导致人声混响大、底噪高,后期无法干净提取。判断标准是,监听时人声的清晰度要像面对面说话一样,不需要提高音量就能听清每个字。例外情况是,如果项目明确要走纪实风格,允许环境声自然混入,那可以降低录音标准,但要在立项阶段写清楚。

拍摄团队还要注意,演员或受访者的语速和音量要稳定,不要忽大忽小。导演在拍摄时要提醒演员,不要对着话筒喊,也不要背对话筒。如果现场有台词改动,要重新录制一遍完整台词,不要只补录几个字,否则后期剪辑时音色不统一。

后期剪辑先铺人声轨道再配音乐

进入剪辑阶段,人声优先级要体现在时间线结构上。剪辑师应该先铺好人声轨道,确定每一句台词或旁白的起止点,然后再添加音乐和音效。这样做的原因是,人声是叙事的主干,音乐和音效要围绕人声来安排,而不是反过来。

具体动作是,剪辑师在时间线上设置三条主要轨道,第一条放人声,第二条放音乐,第三条放音效。人声轨道的音量要设置为基准值,音乐和音效的音量要低于人声,通常音乐峰值不超过人声平均音量的百分之七十,音效不超过人声的百分之五十。这个比例不是绝对,但可以作为初始参考。剪辑师要使用音量自动化曲线,而不是简单调整整体音量,因为不同段落的人声强度不同。

风险在于,如果先铺音乐再找人声位置,容易让人声被音乐节奏带着走,导致语速和画面节奏不匹配。判断标准是,闭上眼睛只听声音,人声的每个字都能听清,音乐不会抢走注意力。例外情况是,有些转场或情绪高潮段落,需要音乐短暂盖过人声,但这类段落要控制在三秒以内,并且要提前在脚本中标注。

剪辑完成后,要输出一个带人声优先级的初步混音版本,给品牌方审看。这个版本不需要精细调音,但要让品牌方确认人声的清晰度和位置是否符合预期。如果品牌方觉得某段人声不清楚,要回到原始素材检查,而不是直接加大音量,因为加大音量会放大底噪。

混音阶段用压缩和均衡器让人声更突出

混音是设置人声优先级的核心技术环节。混音师要使用压缩器控制人声的动态范围,让轻声和大声之间的差距变小,这样整体音量可以更稳定。压缩比通常设置在二比一到四比一之间,启动时间要快,释放时间要适中,避免人声听起来不自然。

具体动作是,混音师先对人声轨道进行降噪处理,去除持续的底噪和电流声。然后使用均衡器,提升人声频段中两千到四千赫兹的范围,这个频段是人声清晰度的关键。同时要衰减两百到三百赫兹的浑浊频段,以及八千赫兹以上的齿音。混音师还要使用去齿音器,避免s和t音过于刺耳。

风险在于,过度压缩会让声音失去自然感,过度提升高频会让声音变尖锐。判断标准是,在普通音箱和手机外放上分别试听,人声都能保持清晰,不闷也不刺耳。例外情况是,如果人声本身录得很好,混音师可以少做处理,只做轻微调整。如果人声素材质量差,混音师要提前告知品牌方,后期处理只能改善,不能完全修复。

混音师还要注意音乐和音效的侧链压缩。侧链压缩的意思是,当人声出现时,音乐和音效的音量会自动降低,人声停止时再恢复。这个技术可以保证人声始终在混音的最前面,但侧链压缩的触发阈值要设置合理,不能让人声一出现音乐就明显抽动,那样会显得不专业。

交付前要按平台要求检查人声响度

商业视频最终要发布到不同平台,每个平台对人声响度有不同的要求。品牌方在交付前要确认目标平台的响度标准,通常是基于LUFS的测量值。如果平台没有明确标准,可以参考通用的响度规范,但要以平台最新官方要求为准。

具体动作是,混音完成后,使用响度表检查整条视频的响度值,确保人声部分在标准范围内。如果响度过高,会导致平台自动压缩,声音失真。如果响度过低,观众需要调大音量,体验不好。同时要检查峰值是否超过零分贝,避免削波。

风险在于,很多项目只检查了整条视频的响度,没有单独检查人声轨道的响度。如果人声被音乐淹没,整条响度正常但人声听不清,那就白混了。判断标准是,用手机外放和耳机分别试听,人声的清晰度要一致。例外情况是,如果视频要同时发布到多个平台,每个平台标准不同,就要输出多个母版,而不是一个版本通用。

交付时还要附带一份声音说明文档,记录人声轨道的原始格式、混音设置、响度数值和平台适配版本。这份文档可以帮助品牌方在后续修改时快速定位问题,不需要重新听一遍全片。

验收环节要逐段确认人声清晰度

品牌方在验收时,不能只看画面,要专门检查声音。验收清单应该包括人声是否清晰、音量是否稳定、有没有底噪、音乐是否抢戏、音效是否突兀。每一项都要有明确的判断标准,而不是凭感觉。

具体动作是,品牌方要准备一份验收表格,列出每个场景或时间码,对应的人声类型和预期效果。验收时,播放视频,逐段记录人声的听感,比如某段人声偏小、某段有回声、某段被音乐盖住。然后把这些反馈发给制作团队,要求修改。

风险在于,品牌方常常只关注画面调色和剪辑节奏,忽略了声音问题。等到发布后才发现人声不清,再修改就要重新混音,成本高且周期长。判断标准是,验收时至少要在三种设备上试听,包括专业监听音箱、普通笔记本电脑扬声器和手机耳机。如果三种设备上人声都清晰,才算合格。

例外情况是,如果项目是纯音乐或纯音效,没有对白,那验收清单就不需要人声项。但如果有旁白或采访,人声验收必须放在第一位。验收通过后,要保存最终混音工程文件,方便后续修改。

人声优先级不适用于所有商业视频

人声优先级不是万能的,有些商业视频类型不适合强行人声优先。比如纯产品展示视频,画面是主角,音乐和音效用来营造氛围,人声可能只是简短的产品名称。这种情况下,如果强行把旁白音量调高,反而会破坏视觉冲击力。

具体判断标准是,看视频的传播目标。如果目标是让观众记住一句话,人声必须优先。如果目标是让观众记住产品外观或使用场景,画面优先,人声辅助。如果目标是建立品牌情绪,音乐和音效优先,人声可以退后。品牌方在立项阶段就要和制作团队达成共识,不要等到后期再改。

风险在于,有些品牌方希望所有视频都人声优先,结果导致音乐和音效被压得太低,视频失去感染力。例外情况是,短视频平台上的快节奏视频,人声往往很短,甚至没有,那就不需要设置人声优先级。还有AIGC生成的视频,如果语音是合成的,清晰度可能不如真人录制,需要额外处理。

制作团队在提案时,要主动询问品牌方的传播场景,判断人声优先级是否适用。如果品牌方说不清楚,可以要求提供竞品参考或投放数据,帮助判断。如果品牌方坚持人声优先,但视频内容本身不适合,制作团队要提出替代方案,而不是盲目执行。

下一步建议从一次声音测试开始

如果你正在准备商业视频项目,建议不要直接进入正式制作,而是先做一次声音优先级测试。选择一段三十秒的样片,按照本文提到的方法设置人声优先级,混音后发给内部团队试听,收集反馈。这个测试可以帮助你提前发现录音设备、混音流程和验收标准的问题,避免在正式项目中踩坑。

测试时要注意,不要只测试理想环境,要模拟真实拍摄条件,比如有背景音乐、有环境噪声、有多个说话人。测试完成后,整理一份声音优先级规范,作为项目文档的一部分。这份规范可以用于后续所有视频项目,减少沟通成本。

如果你需要专业支持,可以联系视频制作团队,让他们提供声音混音的案例和流程说明。但请记住,任何团队都不能保证人声一定清晰,因为声音质量受拍摄条件、设备水平和后期处理共同影响。你要做的是在合同中明确验收标准,比如人声清晰度、响度范围和修改次数,这样交付时才有依据。

如果你正在准备商业视频制作项目,可以先整理Brief、参考画面、产品或企业资料、交付平台和版权范围,再查看视频制作解决方案页面,把沟通从抽象偏好落到可执行的制作边界。