Seedance 2.0 音频生成:Kensa 上的原生音频怎么用(完全指南)
Kensa 上的 Seedance 2.0 会随视频一起生成声音,不额外收费。了解「生成音频」开关怎么用、它做不到什么、提示词技巧,以及与 Veo 3.1 的对比。
Seedance 2.0 音频生成:Kensa 上的原生音频怎么用
Seedance 2.0 会在生成视频的同时生成音频:与画面内容匹配的音效和环境音。在 Kensa 上,音频由一个开关控制——生成音频(Generate Audio),默认开启;带声音的视频和无声视频消耗的 credits 完全相同。本指南讲清楚音频功能能做什么、不能做什么,怎样写提示词让声音更好,费用是多少,以及它和 Kensa 上其他模型的对比——包括同样能生成音频的 Veo 3.1。
2026 年 9 月 28 日更新: 我们按 Kensa 实际提供的功能重写了本指南。旧版介绍了 Kensa 并不具备的功能,还把 Veo 3.1 写错了:Kensa 上每条 Veo 3.1 视频都含音频。
快速解答
| 问题 | Kensa 上的答案 |
|---|---|
| 音频要额外收费吗? | 不用。同一条 Seedance 2.0 视频,有声无声价格相同。 |
| 可以关掉吗? | 可以。关闭「生成音频」即可得到无声视频。 |
| 生成什么样的声音? | 与画面匹配的音效和环境音,由你的提示词引导。 |
| 能上传自己的音乐、人声或音效吗? | 不能。Kensa 只接受图片作为输入,不接受音频或视频文件。 |
| 能给角色一段台词让它说吗? | 没有人声或台词输入。需要准确的台词,请另外录制配音,在剪辑软件里加上。 |
| 还有哪些模型能生成音频? | Veo 3.1(每条都含音频)和 Seedance 1.5 Pro(可选,不额外收费)。Kling 3 正在维护。Grok Image Video 没有音频选项。 |
Seedance 2.0 音频能做什么
声音是和视频一起生成的,而不是事后从音效库里挑一段配上去,所以它会跟着画面走。常见效果包括:
- 与画面动作对应的音效:脚步声、关门声、玻璃杯放到桌上的声音、汽车驶过的声音
- 与场景匹配的环境音:雨声、风声、海浪声、车流声、鸟鸣、咖啡馆里的嘈杂人声
你通过提示词里的文字来引导音频。没有单独的音频提示词,没有音量或混音控制,也不能指定某一段音乐:模型根据你的描述和画面决定声音。生成结果直接嵌在你下载的视频文件里。
在 Kensa 上做不到的事
- 不能输入音频。 不能上传音乐、录音或音效样本来引导或替换音频。Kensa 只接受图片。
- 不能控制人声或台词。 没有填写对白或指定声音的地方。如果视频需要说出特定的话,请录制配音,在剪辑软件里加上。
- 没有单独的音轨文件。 你得到的是一个混好声音的视频文件,而不是分开的音乐和音效分轨。
如何开启音频
- 打开 Seedance 2.0 生成器。 进入 Seedance 2.0 视频生成器。可以只用提示词,也可以上传一张图片让它动起来,或上传两张图片固定首帧和尾帧。
- 写提示词时把声音考虑进去。 除了描述观众看到什么,也描述他们听到什么。可参考下文的技巧。
- 确认「生成音频」开关。 它在生成器的设置菜单里(其他选项旁边的 ⋯ 按钮),默认开启。想要声音就保持开启,想要无声视频就关掉。
- 选择时长、分辨率和宽高比。 Seedance 2.0 支持 4 到 15 秒、480p 或 720p,以及六种宽高比(16:9、9:16、1:1、4:3、3:4 和 21:9)。生成前显示的 credits 数,开不开音频都一样。
- 生成、预览、下载。 下载前先带声音播放一遍。如果声音不理想,调整提示词里对声音的描述,再生成一次。
想了解模型本身,请看 Seedance 2.0 模型页。
费用
Seedance 2.0 按秒计费,开启音频不加价。Kensa 上的原价如下:
| 时长 | 480p | 720p |
|---|---|---|
| 4 秒 | 31 credits | 68 credits |
| 5 秒 | 39 credits | 85 credits |
| 6 秒 | 47 credits | 102 credits |
| 8 秒 | 62 credits | 136 credits |
| 10 秒 | 77 credits | 170 credits |
| 12 秒 | 93 credits | 204 credits |
| 15 秒 | 116 credits | 255 credits |
有优惠活动时,生成器会在你提交前显示优惠后的价格。生成失败时,为这次生成冻结的 credits 会退回你的余额。套餐和积分包请看定价页。
Kensa 各模型的音频对比
| 模型 | Kensa 上的音频 | 音频额外费用 | 时长 | 单条最低价 |
|---|---|---|---|---|
| Seedance 2.0 | 「生成音频」开关,默认开启 | 无 | 4 到 15 秒 | 31 credits(480p,4 秒,原价) |
| Veo 3.1 | 每条都含音频 | 无 | 8 秒 | 13 credits(720p) |
| Seedance 1.5 Pro | 「生成音频」开关,默认开启 | 无 | 4 到 12 秒 | 8 credits(480p,4 秒) |
| Kling 3 | 有声音选项,但模型正在维护 | 不适用 | 5、10 或 15 秒 | 暂不可用 |
| Grok Image Video | 没有音频选项 | 不适用 | 6 或 10 秒 | 5 credits(480p,6 秒) |
做带声音的视频:Seedance 2.0 vs Veo 3.1
两者生成声音都不额外收费,所以选择取决于视频的其他方面:
- Veo 3.1 生成 8 秒 720p 视频,每条都含音频,固定 13 credits。如果 8 秒正合适,它是最简单的选择。它的音频没有开关,无法关闭。详见 Veo 3.1 模型页。
- Seedance 2.0 时长可在 4 到 15 秒之间任选,有六种宽高比(包括 21:9),可以固定首尾帧,音频也可以关闭。它按秒计费,所以每条比 Veo 3.1 贵。
实用的做法:先用短视频验证想法和声音,提示词调好后再生成最终时长。
Seedance 1.5 Pro
Seedance 1.5 Pro 同样有「生成音频」开关且不额外收费,最长 12 秒,支持 1080p 输出。它按秒计费比 Seedance 2.0 便宜,如果你不需要超过 12 秒的时长或参考图,它是更省钱的 Seedance 选择。
提升音频效果的提示词技巧
Seedance 2.0 通过读你的提示词来决定视频该有什么声音,所以描述声音是你最主要的控制手段。
明确描述你想要的声音
模型自己也会加上合理的声音,但把声音写出来,能给它一个清楚得多的目标。
较弱的提示词: 一位厨师在厨房做饭。
更强的提示词: 一位厨师在热锅里翻炒蔬菜,油噼啪作响,水溅进锅里发出嘶嘶的蒸汽声,背景里餐具碰撞、抽油烟机嗡嗡作响。
设定声音氛围
"安静"、"嘈杂"、"有回声"、"闷闷的"、"清脆"这类词会塑造环境音层。
示例: 安静的图书馆,书页轻轻翻动,远处地毯上传来模糊的脚步声,头顶灯光发出微弱的嗡鸣。
拟声词点到为止
"嗖"、"噼啪"、"嗡嗡"、"咚"这类词是清楚的声音线索,每条提示词用一两个就够了。
示例: 跑车加速,低沉的轰鸣逐渐变成咆哮,过弯时轮胎尖啸,驶过镜头时带起一阵呼啸的风声。
从前景到背景分层描述
像音效师搭建声音那样描述:先写主要声音,再写中间层,最后写背景。
示例: 前景:高跟鞋踩在湿漉漉的人行道上发出清脆的声响。中景:细雨声和远处的车流声。背景:远处隐约传来的教堂钟声。
声音与动作的节奏一致
声音的能量要和画面一致。快节奏的动作配平静的环境音,或安静的画面配很响的音效,都会显得别扭。
知道什么时候该后期加音频
需要授权的品牌音乐、特定的配音或准确的台词时,关闭「生成音频」,或准备在后期替换声音。Kensa 无法把这些提供给模型,它们应该在剪辑软件里完成。关闭音频不会降低价格。
自带声音在哪些场景最有用
抖音 / TikTok、Reels 和 Shorts
一条自带匹配环境音和音效的视频,不用去音效库找素材,就能直接拿来做第一轮测试发布。你仍然可以在平台编辑器里叠加热门音乐或配音。
产品视频
细小的声音会让产品画面更真实:倒饮料、盖子咔哒合上、锅里滋滋作响、拉链被拉开。把动作和它的声音写在一起。
空镜与氛围镜头
夜晚的城市街道、拍岸的海浪、热闹的集市,这类建立镜头有了环境音会更有说服力,也不用再去找匹配的素材音乐。
常见问题
Seedance 2.0 的音频要额外扣 credits 吗?
不用。同一条视频,开启「生成音频」和关闭时消耗的 credits 完全相同。
可以生成不带音频的 Seedance 2.0 视频吗?
可以。在生成器设置里关闭「生成音频」,就会得到无声视频。
可以上传音乐、录音或音频参考吗?
不可以。Kensa 只接受图片作为输入(用于图生视频、首尾帧和参考图),不接受音频或视频文件。下载视频后,可以在剪辑软件里加上你自己的音乐或配音。
Kensa 的 Seedance 2.0 支持唇形同步吗?
不支持。Kensa 不提供唇形同步:没有办法给角色指定台词或声音。需要准确台词的口播视频,请另外录制配音,或使用专门的数字人工具。
Kensa 上的 Veo 3.1 会生成音频吗?
会。Kensa 上的每条 Veo 3.1 视频都是 8 秒 720p,并且含音频,固定 13 credits。
Kensa 上的 Kling 3 会生成音频吗?
Kling 3 在 Kensa 上有声音选项,但该模型目前正在维护,暂时不能用来生成新视频。
生成的视频可以商用吗?
Pro 和 Ultimate 套餐以及 Premium 积分包包含 Kensa 视频的商业使用权。详情请看定价页。
开始使用
如果你是 Kensa 新用户,用 Google 注册可获得 15 个免费 credits,3 天内有效,够生成一条带声音的 Veo 3.1 视频(13 credits);原价的 Seedance 2.0 视频 31 credits 起。
从一个声音元素明确的场景开始,比如暴雨、热闹的咖啡馆或滋滋作响的煎锅,在 Seedance 2.0 视频生成器里开启「生成音频」生成一条,听听声音是怎样跟着画面走的。
想了解 Seedance 2.0 的全部功能,请阅读 Seedance 2.0 完全指南。想低成本让照片动起来、声音自己后期加,请看 Grok Image Video 指南。
相关文章
Seedance 2.0 完全指南 — 字节跳动最强 AI 视频模型(2026)
Seedance 2.0 完全指南:参数详解、定价方案(480p 起步 7.7 credits/秒)、提示词技巧,以及如何在 Kensa 上使用这款全球首批上线的模型。
Sora 2 已停服:为什么 Seedance 2.0 是 2026 年最佳替代方案
OpenAI Sora 2 已于 2026 年 4 月正式停服。了解停服原因,以及为什么字节跳动 Seedance 2.0 凭借免费音频、唇形同步、首尾帧控制等功能,成为更优秀的替代选择。
Seedance 2.0 vs Sora 2:2026 年该选哪款 AI 视频模型?
字节跳动 Seedance 2.0 与 OpenAI Sora 2 全面对比。从功能、定价、画质、音频到应用场景,帮你选择最合适的 AI 视频模型。