必须分层处理对白与环境声:3.0 pro铂金会员可在提示词末尾用“+音效:[类型]+[强度]+[空间感]”嵌入自然音效;或生成后通过“添加ai音效”功能文字描述/上传参考音频补全;3.0 pro还支持上传带声参考视频实现帧级音画同步。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

要在可灵AI中生成带背景声音的视频,必须明确区分“对白”与“环境声/音效”的控制路径——可灵3.0 Pro不支持在文生视频提示词中直接混写人声台词和风声雨声,二者需分层处理。
确认当前模型版本与权限
登录可灵官网或App,点击右上角头像→「账户中心」→查看「模型版本」。只有显示“Kling 3.0 Pro”且会员等级为铂金及以上,才具备原生音效叠加能力。免费版或可灵2.6用户无法调用背景音生成功能,【强行提交含音效描述的提示词将被静默忽略】。
若版本不符,请先升级至铂金会员并等待系统推送3.0 Pro权限(通常在开通后2小时内生效)。
方法一:在提示词中嵌入环境声关键词(仅限3.0 Pro)
这一步适用于需要与画面强同步的自然环境音,如雨声、鸟鸣、海浪等。
在原始提示词末尾添加固定格式的音效指令:+音效:[类型]+[强度]+[空间感]。例如:
“一只白鹭掠过湿地水面,翅膀拍打空气,芦苇丛沙沙作响 +音效:自然环境-轻度-近场”
注意:方括号内三项必须齐全,缺一不可;“类型”仅支持预设值:自然环境、城市街道、室内空间、机械运转、动物活动;“强度”限定为轻度/中度/强烈;“空间感”仅限近场/中距/远场。填错任意一项,整条音效指令失效。
方法二:生成视频后单独添加AI音效(全版本可用)
第一步:完成视频生成并保存至「我的作品」。
第二步:在作品卡片右下角点击「…」→选择「添加AI音效」。
第三步:在弹出面板中,先上传一段1–3秒的参考音频(如真实雨声采样),或直接输入文字描述,例如:“老式咖啡馆,背景有低语声、咖啡机蒸汽声、瓷杯轻碰声,中距离,温暖混响”。
第四步:点击生成,系统将输出4条候选音轨,每条时长严格匹配原视频长度,无需手动对齐。
这一步操作起来很简单,直接把文件拖进去就行。但要注意:【参考音频采样率必须≥44.1kHz,否则音效生成质量断崖式下降】。
方法三:用多模态参考视频引导音效生成(3.0 Pro专属)
当你已有带目标环境声的参考视频(比如一段5秒的森林晨间实录),可将其作为声音锚点驱动新视频音效生成。
① 在文生视频页面点击「高级模式」→开启「多模态参考」。
② 上传参考视频(MP4/MOV格式,≤20MB)→勾选「以该视频音频为声音基准」。
③ 输入主提示词,例如:“穿红裙的小女孩在林间小径奔跑,落叶在脚下翻飞”,不加任何音效描述词。
④ 提交生成。系统会自动提取参考视频中的频谱特征,并将其迁移至新视频的动作节奏中,实现落叶声与脚步声的帧级同步。
该方法对物理运动类音效(脚步、碰撞、摩擦)效果极佳,但无法迁移人声对话或乐器旋律。











