如何用参考图让角色保持一致
在 Kensa 的参考图生视频工具中上传 1 到 3 张参考图,用 Veo 3.1 或 Seedance 2.0 把同一个角色、吉祥物或商品放进新场景。
- 阅读时长
- 阅读约 3 分钟
- 使用模型
- Veo 3.1
- 典型积分消耗
- 典型消耗 13 积分(8 秒)
快速步骤
挑选 1 到 3 张参考图
选择同一个主体的清晰图片:角色、吉祥物或商品。支持 JPG、PNG、WEBP,每张不超过 10MB。同一主体的不同角度能帮助模型保持一致。
描述新场景
把提示词写成一个镜头:参考图里的主体在做什么、在哪里、镜头怎么动、光线如何。用「参考图中的角色」来指代主体,不要再重新描述它的外貌。
选择模型和画幅
Veo 3.1 生成 8 秒带音频的片段,固定 13 积分;Seedance 2.0 按秒计费(480p 为 7.7 积分/秒)。横屏选 16:9,竖屏选 9:16。
生成并检查
生成后检查主体是否还像参考图,不像就只改提示词的一处再试。生成失败时,预留的积分会退回。
如何用参考图让角色保持一致
只靠文字提示词,每次生成的角色都长得不一样。参考图生视频 工具可以解决这个问题:上传 1 到 3 张主体的图片,描述一个新场景,模型生成的片段里主体会保持参考图中的样子。本文介绍怎么选图、怎么写提示词,以及每个模型的费用。
准备什么
- 1 到 3 张参考图,内容是同一个主体:角色、吉祥物或商品。支持 JPG、PNG、WEBP,每张不超过 10MB。只能用图片,视频和音频文件不能作为参考。
- 积分。 Veo 3.1 每条 8 秒片段固定 13 积分。Seedance 2.0 按秒计费:480p 为 7.7 积分/秒,720p 为 16.9 积分/秒。用 Google 登录注册的新账户获赠 15 积分,够生成一条 Veo 3.1 片段。
参考图生视频还是图生视频?
| 图生视频 | 参考图生视频 | |
|---|---|---|
| 图片的作用 | 作为片段的第一帧 | 告诉模型主体长什么样 |
| 第一帧 | 就是你的图片 | 模型重新构图的新场景 |
| 图片数量 | 1 张(或起始帧加结束帧) | 同一主体 1 到 3 张 |
| 适合 | 想让这张照片原样动起来 | 想让同一个主体出现在不同场景 |
想让一张商品照片原样动起来,用 图生视频。想让同一个吉祥物在三条片段里分别走过集市、站上舞台、坐在书桌前,用参考图生视频。
第一步:选好参考图
参考图是模型了解主体外貌的唯一来源,图片质量比任何设置都重要:
- 主体完整清晰。 不要裁掉头部,不要让手挡住商品。
- 背景尽量简单。 纯色或虚化的背景能让模型分清哪些属于主体。
- 每张图都是同一个主体。 参考图里有两个不同角色,生成结果会混合两者。
- 多给角度,不要多给变化。 正面加侧面有帮助;三套不同的衣服会让模型困惑。
- 图片上不要有文字和水印,它们容易出现在视频里。
第二步:描述新场景
按这个顺序写一个镜头:主体在做什么、在哪里、镜头怎么动、光线和风格。用参考图来指代主体,不要再描述它的外貌:
参考图中的角色撑着纸伞走过下雨的夜市,霓虹招牌倒映在湿漉漉的地面上。镜头从侧面缓慢跟拍,浅景深,电影感光线。
商品的例子:
参考图中的运动鞋放在夜晚湿润的城市街道上,一位跑者走进画面,镜头推近到鞋子,霓虹倒影,电影感光线。
如果生成结果和主体不像,就把提示词里描述外貌的形容词删掉,它们会和参考图互相抵消。
第三步:选择模型和画幅
| Veo 3.1 | Seedance 2.0 | |
|---|---|---|
| 价格 | 每条 13 积分 | 7.7 积分/秒(480p),16.9 积分/秒(720p) |
| 片段 | 8 秒,带音频 | 按秒计费 |
| 适合 | 低成本快速试场景 | 更长或更高清的片段 |
横屏视频(YouTube、商品详情页)选 16:9,竖屏视频(抖音、TikTok、Reels、Shorts)选 9:16,两个模型都支持这两种画幅。生成前会显示准确的积分消耗。
第四步:生成并检查
大多数片段几分钟内完成。检查两点:主体是否还像参考图,场景是否符合提示词。不理想就每次只改一处(换一张更清晰的图、简化动作、换一种镜头运动)再生成。生成失败时,为它预留的积分会退回余额。
哪些内容会被拦截
生成前会审核图片和提示词,模型本身也有安全过滤。参考图请求被拒的最常见原因:
- 真人照片,尤其是明星和公众人物
- 品牌 logo、商标和受版权保护的角色
- 违反使用政策的内容
原创角色、插画吉祥物、你自己的商品和风格化插画效果最好。
立即尝试
打开 参考图生视频,上传你的角色或商品图片,试试上面的示例提示词。