返回博客
tutorialsmodels

Seedance 2.0 音频生成:Kensa 上的原生音频怎么用(完全指南)

Kensa 上的 Seedance 2.0 会随视频一起生成声音,不额外收费。了解「生成音频」开关怎么用、它做不到什么、提示词技巧,以及与 Veo 3.1 的对比。

2026年4月4日14 min readKensa Editorial Team

Seedance 2.0 音频生成:Kensa 上的原生音频怎么用

Seedance 2.0 会在生成视频的同时生成音频:与画面内容匹配的音效和环境音。在 Kensa 上,音频由一个开关控制——生成音频(Generate Audio),默认开启;带声音的视频和无声视频消耗的 credits 完全相同。本指南讲清楚音频功能能做什么、不能做什么,怎样写提示词让声音更好,费用是多少,以及它和 Kensa 上其他模型的对比——包括同样能生成音频的 Veo 3.1。

2026 年 9 月 28 日更新: 我们按 Kensa 实际提供的功能重写了本指南。旧版介绍了 Kensa 并不具备的功能,还把 Veo 3.1 写错了:Kensa 上每条 Veo 3.1 视频都含音频。

快速解答

问题Kensa 上的答案
音频要额外收费吗?不用。同一条 Seedance 2.0 视频,有声无声价格相同。
可以关掉吗?可以。关闭「生成音频」即可得到无声视频。
生成什么样的声音?与画面匹配的音效和环境音,由你的提示词引导。
能上传自己的音乐、人声或音效吗?不能。Kensa 只接受图片作为输入,不接受音频或视频文件。
能给角色一段台词让它说吗?没有人声或台词输入。需要准确的台词,请另外录制配音,在剪辑软件里加上。
还有哪些模型能生成音频?Veo 3.1(每条都含音频)和 Seedance 1.5 Pro(可选,不额外收费)。Kling 3 正在维护。Grok Image Video 没有音频选项。

Seedance 2.0 音频能做什么

声音是和视频一起生成的,而不是事后从音效库里挑一段配上去,所以它会跟着画面走。常见效果包括:

  • 与画面动作对应的音效:脚步声、关门声、玻璃杯放到桌上的声音、汽车驶过的声音
  • 与场景匹配的环境音:雨声、风声、海浪声、车流声、鸟鸣、咖啡馆里的嘈杂人声

你通过提示词里的文字来引导音频。没有单独的音频提示词,没有音量或混音控制,也不能指定某一段音乐:模型根据你的描述和画面决定声音。生成结果直接嵌在你下载的视频文件里。

在 Kensa 上做不到的事

  • 不能输入音频。 不能上传音乐、录音或音效样本来引导或替换音频。Kensa 只接受图片。
  • 不能控制人声或台词。 没有填写对白或指定声音的地方。如果视频需要说出特定的话,请录制配音,在剪辑软件里加上。
  • 没有单独的音轨文件。 你得到的是一个混好声音的视频文件,而不是分开的音乐和音效分轨。

如何开启音频

  1. 打开 Seedance 2.0 生成器。 进入 Seedance 2.0 视频生成器。可以只用提示词,也可以上传一张图片让它动起来,或上传两张图片固定首帧和尾帧。
  2. 写提示词时把声音考虑进去。 除了描述观众看到什么,也描述他们听到什么。可参考下文的技巧。
  3. 确认「生成音频」开关。 它在生成器的设置菜单里(其他选项旁边的 ⋯ 按钮),默认开启。想要声音就保持开启,想要无声视频就关掉。
  4. 选择时长、分辨率和宽高比。 Seedance 2.0 支持 4 到 15 秒、480p 或 720p,以及六种宽高比(16:9、9:16、1:1、4:3、3:4 和 21:9)。生成前显示的 credits 数,开不开音频都一样。
  5. 生成、预览、下载。 下载前先带声音播放一遍。如果声音不理想,调整提示词里对声音的描述,再生成一次。

想了解模型本身,请看 Seedance 2.0 模型页。

费用

Seedance 2.0 按秒计费,开启音频不加价。Kensa 上的原价如下:

时长480p720p
4 秒31 credits68 credits
5 秒39 credits85 credits
6 秒47 credits102 credits
8 秒62 credits136 credits
10 秒77 credits170 credits
12 秒93 credits204 credits
15 秒116 credits255 credits

有优惠活动时,生成器会在你提交前显示优惠后的价格。生成失败时,为这次生成冻结的 credits 会退回你的余额。套餐和积分包请看定价页。

Kensa 各模型的音频对比

模型Kensa 上的音频音频额外费用时长单条最低价
Seedance 2.0「生成音频」开关,默认开启无4 到 15 秒31 credits(480p,4 秒,原价)
Veo 3.1每条都含音频无8 秒13 credits(720p)
Seedance 1.5 Pro「生成音频」开关,默认开启无4 到 12 秒8 credits(480p,4 秒)
Kling 3有声音选项,但模型正在维护不适用5、10 或 15 秒暂不可用
Grok Image Video没有音频选项不适用6 或 10 秒5 credits(480p,6 秒)

做带声音的视频:Seedance 2.0 vs Veo 3.1

两者生成声音都不额外收费,所以选择取决于视频的其他方面:

  • Veo 3.1 生成 8 秒 720p 视频,每条都含音频,固定 13 credits。如果 8 秒正合适,它是最简单的选择。它的音频没有开关,无法关闭。详见 Veo 3.1 模型页。
  • Seedance 2.0 时长可在 4 到 15 秒之间任选,有六种宽高比(包括 21:9),可以固定首尾帧,音频也可以关闭。它按秒计费,所以每条比 Veo 3.1 贵。

实用的做法:先用短视频验证想法和声音,提示词调好后再生成最终时长。

Seedance 1.5 Pro

Seedance 1.5 Pro 同样有「生成音频」开关且不额外收费,最长 12 秒,支持 1080p 输出。它按秒计费比 Seedance 2.0 便宜,如果你不需要超过 12 秒的时长或参考图,它是更省钱的 Seedance 选择。

提升音频效果的提示词技巧

Seedance 2.0 通过读你的提示词来决定视频该有什么声音,所以描述声音是你最主要的控制手段。

明确描述你想要的声音

模型自己也会加上合理的声音,但把声音写出来,能给它一个清楚得多的目标。

较弱的提示词: 一位厨师在厨房做饭。

更强的提示词: 一位厨师在热锅里翻炒蔬菜,油噼啪作响,水溅进锅里发出嘶嘶的蒸汽声,背景里餐具碰撞、抽油烟机嗡嗡作响。

设定声音氛围

"安静"、"嘈杂"、"有回声"、"闷闷的"、"清脆"这类词会塑造环境音层。

示例: 安静的图书馆,书页轻轻翻动,远处地毯上传来模糊的脚步声,头顶灯光发出微弱的嗡鸣。

拟声词点到为止

"嗖"、"噼啪"、"嗡嗡"、"咚"这类词是清楚的声音线索,每条提示词用一两个就够了。

示例: 跑车加速,低沉的轰鸣逐渐变成咆哮,过弯时轮胎尖啸,驶过镜头时带起一阵呼啸的风声。

从前景到背景分层描述

像音效师搭建声音那样描述:先写主要声音,再写中间层,最后写背景。

示例: 前景:高跟鞋踩在湿漉漉的人行道上发出清脆的声响。中景:细雨声和远处的车流声。背景:远处隐约传来的教堂钟声。

声音与动作的节奏一致

声音的能量要和画面一致。快节奏的动作配平静的环境音,或安静的画面配很响的音效,都会显得别扭。

知道什么时候该后期加音频

需要授权的品牌音乐、特定的配音或准确的台词时,关闭「生成音频」,或准备在后期替换声音。Kensa 无法把这些提供给模型,它们应该在剪辑软件里完成。关闭音频不会降低价格。

自带声音在哪些场景最有用

抖音 / TikTok、Reels 和 Shorts

一条自带匹配环境音和音效的视频,不用去音效库找素材,就能直接拿来做第一轮测试发布。你仍然可以在平台编辑器里叠加热门音乐或配音。

产品视频

细小的声音会让产品画面更真实:倒饮料、盖子咔哒合上、锅里滋滋作响、拉链被拉开。把动作和它的声音写在一起。

空镜与氛围镜头

夜晚的城市街道、拍岸的海浪、热闹的集市,这类建立镜头有了环境音会更有说服力,也不用再去找匹配的素材音乐。

常见问题

Seedance 2.0 的音频要额外扣 credits 吗?

不用。同一条视频,开启「生成音频」和关闭时消耗的 credits 完全相同。

可以生成不带音频的 Seedance 2.0 视频吗?

可以。在生成器设置里关闭「生成音频」,就会得到无声视频。

可以上传音乐、录音或音频参考吗?

不可以。Kensa 只接受图片作为输入(用于图生视频、首尾帧和参考图),不接受音频或视频文件。下载视频后,可以在剪辑软件里加上你自己的音乐或配音。

Kensa 的 Seedance 2.0 支持唇形同步吗?

不支持。Kensa 不提供唇形同步:没有办法给角色指定台词或声音。需要准确台词的口播视频,请另外录制配音,或使用专门的数字人工具。

Kensa 上的 Veo 3.1 会生成音频吗?

会。Kensa 上的每条 Veo 3.1 视频都是 8 秒 720p,并且含音频,固定 13 credits。

Kensa 上的 Kling 3 会生成音频吗?

Kling 3 在 Kensa 上有声音选项,但该模型目前正在维护,暂时不能用来生成新视频。

生成的视频可以商用吗?

Pro 和 Ultimate 套餐以及 Premium 积分包包含 Kensa 视频的商业使用权。详情请看定价页。

开始使用

如果你是 Kensa 新用户,用 Google 注册可获得 15 个免费 credits,3 天内有效,够生成一条带声音的 Veo 3.1 视频(13 credits);原价的 Seedance 2.0 视频 31 credits 起。

从一个声音元素明确的场景开始,比如暴雨、热闹的咖啡馆或滋滋作响的煎锅,在 Seedance 2.0 视频生成器里开启「生成音频」生成一条,听听声音是怎样跟着画面走的。

想了解 Seedance 2.0 的全部功能,请阅读 Seedance 2.0 完全指南。想低成本让照片动起来、声音自己后期加,请看 Grok Image Video 指南。

准备好创建AI视频了吗?

免费试用 Kensa:用 Google 注册送 15 积分

Kensa 新上线 MiniMax H3(海螺3):5–15 秒带音频,最高 2K →

立即开始

相关文章