AI 商品模特视频最容易让人兴奋的,是一张产品图就能延展出不同人物、场景和市场版本;最容易翻车的,也恰恰是“每一条都能生成”。脸在变、服装在变、产品比例在变,上一镜还像同一支 campaign,下一镜就像临时换了品牌。
想让 AI 模特真正进入广告生产,不要从一句长提示词开始,而要先做一份 continuity bible:角色、服装、动作、镜头、产品与披露规则都被锁定后,生成才从灵感抽卡变成可审片的制作流程。
先定义角色资产,不要只追求“同一张脸”
角色连续性不只包含五官。发型轮廓、妆面强度、肤色基准、身材比例、年龄气质、常用表情和品牌姿态,都需要形成一组可对照的 reference frames。美妆品牌和运动品牌对“自信”的理解完全不同,一个偏克制、一个偏能量,角色表演必须跟着品牌语气走。
建议先生成正面、四分之三侧面、侧面和半身动作四类基准图,再写一页角色禁区:不出现哪些表情、妆容、首饰、手势和镜头畸变。后续每条片先和这组基准对照,不合格就回到生成节点,而不是让调色和剪辑替角色漂移买单。
五层控制板,把连续性变成审片语言

审片时别再用“感觉不像了”这种模糊反馈。把问题归进五个文件夹:角色是否漂移、服装材质是否连续、动作是否符合人体逻辑、镜头是否仍在同一视觉系统、发布时是否完成必要披露。反馈越具体,重生成越少,campaign 越容易保持同一个调性。
产品真实感,要比模特漂亮更优先
商品视频不是数字人样片,产品必须是每一镜的锚点。包装比例、Logo 位置、按钮数量、接口结构、液体颜色和使用方向都要建立产品 reference。涉及手持时,还要重点检查接触点、遮挡关系、手指数量、受力方向和镜面反射。
一个实用做法是把镜头拆成两条验收线:第一条只看人物和表演,第二条只看产品结构与卖点证据。人物过关但产品变形,仍然不能进入剪辑。必要时使用真实 packshot、局部实拍或三维产品替换生成部分,让“人”保持灵活,让“货”保持准确。
动作设计要写动词,也要写起点和终点
“模特优雅地使用产品”太松了。更可控的写法是:右手从桌面拿起设备,停在肩部高度,视线先看产品再看镜头,动作结束时产品正面保持可见。动词、路径、停顿和最终构图都明确,连续镜头才有剪辑点。
镜头运动也同理。推近、横移、环绕和锁定各自承担不同任务,别在一个短镜头里把所有动势都塞满。可以沿用AI 产品视频提示词的镜头系统,把焦段感、景别、光向、产品占比和结尾留白写进可重复字段。
服装与场景,需要为多市场版本留接口
跨境 campaign 经常要换季节、肤色、语言和生活场景。更稳妥的方式不是每个市场重新发明一位模特,而是保留同一角色核心,调整服装层级、道具、背景和动作语境。品牌色可以落在服装局部或环境 practical light 上,不必每一镜都铺满。
同时提前划分哪些元素允许变化、哪些绝对不变。产品外观、核心角色、主光逻辑和 packshot 构图通常属于锁定项;场景道具、局部色彩、字幕区和开场 hook 可以成为版本变量。这样既能本地化,也不会把品牌视觉拆散。
平台披露要在交付表里,不要上线前才想起
AI 角色看起来越真实,透明度越要前置。TikTok 的 AI 生成内容说明要求现实感图像、音频和视频按规则标注;YouTube 的 合成或重大修改内容披露说明也要求对看似真实的相关内容进行披露。
所以版本表除了片长、画幅、字幕和音轨,还应加入“是否含现实感 AIGC”“人物或声音授权状态”“平台披露开关”“生成来源与修改记录”。这不是给创意踩刹车,而是让成片能顺利进入投放、客户审核和后续复用。
常见问题:AI 模特可以完全替代实拍吗
什么产品更适合先尝试 AI 模特视频?
角色氛围和场景变化价值高、产品结构相对稳定的品类更容易落地,例如时尚配饰、部分美妆内容和生活方式短片。需要精确操作、医疗主张或复杂受力证明时,应保留更多实拍证据。
同一角色做十条视频,为什么还是会漂?
常见原因是只有一张脸部参考,没有锁定发型、服装、身体比例、光线与镜头语言。角色一致性是整套视觉变量共同作用的结果。
怎样降低客户审片时的主观争议?
先审批角色基准、产品基准和一条运动测试,再进入批量生成。每轮只比较明确字段,并保留被批准的 reference,不要边批量生产边重新定义角色。
