可以完成口播版本,但只要卖点需要真实接触、物理反馈或产品状态变化,就不该让数字人包办。深圳AI数字人产品视频制作公司面对“数字人能不能把整条产品片做完”这个问题,判断方法其实很明确:数字人负责稳定地说,真手和实物负责让观众看见产品真的做了什么。两类镜头可以出现在同一条片里,却不需要互相伪装。

虚拟形象已经不是小众形式。YouTube 在 2025 年发布的虚拟创作者趋势报告中提到,抽样的 300 个虚拟创作者在 2024 年获得超过 150 亿次观看;报告同时强调,虚拟形象背后仍需要人的连接。放到产品视频里,这个“人”未必必须全程露脸,却要体现在可信动作、正确反馈和清楚的制作记录中。数字人可以提升多版本口播效率,产品价值仍要由画面里的事实承担。

直接答案:口播可以生成,产品反馈不能凭嘴说明

一句“支持三档风速”,数字人几秒就能说完;画面却要回答手指按在哪个键、指示灯何时变化、风从哪里被看见。磁吸盒盖要有落位,旋钮要停在正确刻度,App 操作要与实物响应同步。只要卖点包含这种因果关系,实体镜头就不是装饰性 B-roll,而是那句话能否成立的主要画面。

采购方可以先把人物声道静音,只看画面能否理解产品做了什么。如果静音后只剩数字人点头、背景轻微移动和几张产品图,说明脚本把卖点都压在了口播上;如果观众能看懂按键、开启、佩戴、对比与结果,数字人才真正承担了“解释”而不是“遮住缺少的实拍”。这一点与 ONCE 关于TikTok Shop 产品视频先处理购买犹豫的做法相通:人物提出问题,动作把答案交出来。

因此,数字人能否完成整条视频,不取决于形象有多真实,而取决于产品卖点是否只需要语言。如果项目只是课程提示、软件功能概览或固定信息播报,生成比例可以更高;如果观众需要判断尺寸、触感、光效、操作难度与真实反馈,实拍比例就要上升。

成立条件:哪些产品内容可以主要使用数字人

数字人更适合三类任务。第一类是内容结构稳定、语言版本较多的口播,例如同一段功能介绍需要英语、西班牙语和德语版本;第二类是人物不与实物直接接触的解释段,例如在画面一侧说明参数差异;第三类是后续经常更新的运营信息,例如活动开头、渠道提示或版本号变化。它们共同的特点是:修改一句话,不会改变产品的物理表现。

即使主要使用数字人,也要先把交付条件写清。形象是品牌自有还是项目期使用,声音是否单独制作,背景能否替换,后续改文案由谁生成,源项目是否可继续编辑,都应进入报价。只收到一条 MP4,并不等于品牌获得了一个可以持续更新的数字人资产。

数字人口播还需要统一画面规则。中近景的主光从哪侧来、眼神看镜头还是看产品、背景留出多少空间、字幕放在哪个安全区域,这些都会影响后续真手和产品镜头能否顺利接入。数字人从左侧受光,下一条真手却从右侧亮起,即使每条素材单看都精致,连续播放仍会显得像两个项目。

操作方法:把一句卖点拆成“说”和“用”

镜头表可以多加两列:“数字人说什么”和“产品正在做什么”。以“三档风速”为例,口播列写清第一、第二、第三档的差异;动作列分别安排手指落点、指示灯切换和头发或纸条的反馈。数字人说到“第三档”时,画面必须正好到第三档,而不是靠后期加速让实物追上声音。

真手实拍要记录动作起点、终点和停顿长度。按键后留出设备响应时间,旋钮转完让刻度正对镜头,拿起产品前拍一条无人接触的干净底板;涉及屏幕或 App,则把每次点击与设备反馈写进场记。口播确定节奏后,剪辑可以沿这些节点对齐关键词,不必抽帧把动作剪得发飘。

一条混合产品片通常包含数字人中近景、真手操作特写与产品英雄镜头。三类素材提前统一背景色、光向、镜头高度和色温;产品英雄镜头再单独处理反光、微距与运动。数字人不必生成一双假手去碰产品,真手也不必假装属于数字人本人,只要切换逻辑明确,观众会把它理解为正常的景别变化。

例外情况:真人、真手和实物必须留下的时刻

当卖点来自人的真实体验时,真人很难被完全替代。风吹动头发的方向、耳机入耳后的轻微调整、手掌受到震动后的反应、屏幕亮起对面部的补光,都需要人物、实物与现场光线处在同一个空间。创始人讲为什么做产品、用户描述一次真实选择,也依赖停顿、犹豫和语气。数字人可以读准文字,却不应顺手抹掉这些真正有信息的反应。

品牌可以让数字人承担参数段,把真人回答留给项目起点和关键判断。ONCE 的海外众筹创始人视频拍摄复盘说明了逐字口播与自然回答的不同用途。需要手部演示时,则固定肤色、指甲状态、左右手方向和动作速度,并拍连续性照片;需要产品状态变化时,准备可复位样品与干净底板,避免后期只能用生成画面补一个本该实拍的关键动作。

真人脸、声音或既有视频若要进入生成,也应先明确使用方式:谁出镜、谁配音、是否使用声音克隆、用于哪些语言和平台、可以生成多少版本、源文件如何保存。YouTube 的人物相似性申诉说明提示,即使做了 AI 披露,也不等于自动取得人物形象使用许可。采购方不宜只收普通拍摄授权,还应把数字化处理、声音或形象生成、语言版本与使用期限写清;相关交付也可参考 ONCE 的海外社媒 UGC 广告三份交付文件

相关追问:平台标签、语言版本与报价怎么交

同一条母版进入不同平台,上传前要重新检查当下的 AI 内容选项。YouTube 的生成式 AI 内容披露说明要求创作者对看起来真实、且经过实质生成或改动的内容进行披露。TikTok 的AI 生成内容说明提供创作者标签和自动标签,并说明真实感图像、音频与视频的标注要求。品牌不能把“成片里没写 AI”理解为上传端也无需处理。

Meta 在 2026 年 6 月更新的广告 AI 信息说明中表示,广告的“About this ad”将整合 AI 信息,并开始通过行业标准信号识别第三方工具创建或编辑的广告。交付包因此最好加入一页发布备注:哪些镜头使用数字人、哪些是真人实拍、人物素材与授权放在哪里、各平台由谁完成上传设置。

多语言版本还要逐版检查嘴型、字幕、产品界面与口播数值。数字人改成英文,实物屏幕上的单位不会自动变化;口播说第三档、指示灯停在第二档,也比轻微嘴型误差更影响理解。报价应把形象、声音、真手实拍、产品英雄镜头、语言版本和后续改版分别列明,验收则分别看嘴型与眼神、品牌名与数字读法、动作连续性、横竖版和平台备注。

如果你正在判断一条产品片能否主要使用数字人,可以把脚本、产品动作、真人素材、目标语言和投放平台发给 ONCE VISUAL,我们会先回答哪些段落可以生成、哪些镜头必须实拍,再据此安排数字人、真手与产品特写的混合制作。