返回指南

如何用参考图让角色保持一致

在 Kensa 的参考图生视频工具中上传 1 到 3 张参考图,用 Veo 3.1 或 Seedance 2.0 把同一个角色、吉祥物或商品放进新场景。

阅读时长
阅读约 3 分钟
使用模型
Veo 3.1
典型积分消耗
典型消耗 13 积分(8 秒)

快速步骤

1

挑选 1 到 3 张参考图

选择同一个主体的清晰图片:角色、吉祥物或商品。支持 JPG、PNG、WEBP,每张不超过 10MB。同一主体的不同角度能帮助模型保持一致。

2

描述新场景

把提示词写成一个镜头:参考图里的主体在做什么、在哪里、镜头怎么动、光线如何。用「参考图中的角色」来指代主体,不要再重新描述它的外貌。

3

选择模型和画幅

Veo 3.1 生成 8 秒带音频的片段,固定 13 积分;Seedance 2.0 按秒计费(480p 为 7.7 积分/秒)。横屏选 16:9,竖屏选 9:16。

4

生成并检查

生成后检查主体是否还像参考图,不像就只改提示词的一处再试。生成失败时,预留的积分会退回。

如何用参考图让角色保持一致

只靠文字提示词,每次生成的角色都长得不一样。参考图生视频 工具可以解决这个问题:上传 1 到 3 张主体的图片,描述一个新场景,模型生成的片段里主体会保持参考图中的样子。本文介绍怎么选图、怎么写提示词,以及每个模型的费用。

准备什么

  • 1 到 3 张参考图,内容是同一个主体:角色、吉祥物或商品。支持 JPG、PNG、WEBP,每张不超过 10MB。只能用图片,视频和音频文件不能作为参考。
  • 积分。 Veo 3.1 每条 8 秒片段固定 13 积分。Seedance 2.0 按秒计费:480p 为 7.7 积分/秒,720p 为 16.9 积分/秒。用 Google 登录注册的新账户获赠 15 积分,够生成一条 Veo 3.1 片段。

参考图生视频还是图生视频?

图生视频参考图生视频
图片的作用作为片段的第一帧告诉模型主体长什么样
第一帧就是你的图片模型重新构图的新场景
图片数量1 张(或起始帧加结束帧)同一主体 1 到 3 张
适合想让这张照片原样动起来想让同一个主体出现在不同场景

想让一张商品照片原样动起来,用 图生视频。想让同一个吉祥物在三条片段里分别走过集市、站上舞台、坐在书桌前,用参考图生视频。

第一步:选好参考图

参考图是模型了解主体外貌的唯一来源,图片质量比任何设置都重要:

  • 主体完整清晰。 不要裁掉头部,不要让手挡住商品。
  • 背景尽量简单。 纯色或虚化的背景能让模型分清哪些属于主体。
  • 每张图都是同一个主体。 参考图里有两个不同角色,生成结果会混合两者。
  • 多给角度,不要多给变化。 正面加侧面有帮助;三套不同的衣服会让模型困惑。
  • 图片上不要有文字和水印,它们容易出现在视频里。

第二步:描述新场景

按这个顺序写一个镜头:主体在做什么、在哪里、镜头怎么动、光线和风格。用参考图来指代主体,不要再描述它的外貌:

参考图中的角色撑着纸伞走过下雨的夜市,霓虹招牌倒映在湿漉漉的地面上。镜头从侧面缓慢跟拍,浅景深,电影感光线。

商品的例子:

参考图中的运动鞋放在夜晚湿润的城市街道上,一位跑者走进画面,镜头推近到鞋子,霓虹倒影,电影感光线。

如果生成结果和主体不像,就把提示词里描述外貌的形容词删掉,它们会和参考图互相抵消。

第三步:选择模型和画幅

Veo 3.1Seedance 2.0
价格每条 13 积分7.7 积分/秒(480p),16.9 积分/秒(720p)
片段8 秒,带音频按秒计费
适合低成本快速试场景更长或更高清的片段

横屏视频(YouTube、商品详情页)选 16:9,竖屏视频(抖音、TikTok、Reels、Shorts)选 9:16,两个模型都支持这两种画幅。生成前会显示准确的积分消耗。

第四步:生成并检查

大多数片段几分钟内完成。检查两点:主体是否还像参考图,场景是否符合提示词。不理想就每次只改一处(换一张更清晰的图、简化动作、换一种镜头运动)再生成。生成失败时,为它预留的积分会退回余额。

哪些内容会被拦截

生成前会审核图片和提示词,模型本身也有安全过滤。参考图请求被拒的最常见原因:

  • 真人照片,尤其是明星和公众人物
  • 品牌 logo、商标和受版权保护的角色
  • 违反使用政策的内容

原创角色、插画吉祥物、你自己的商品和风格化插画效果最好。

立即尝试

打开 参考图生视频,上传你的角色或商品图片,试试上面的示例提示词。

准备好了吗?

立即尝试