必须开通svip权限并完成企业邮箱验证才能使用语音克隆功能;上传4–6分钟高质量单人录音样本后生成克隆音色,测试满意即可在视频中启用“myvoice”声线。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

想在VibeKnow生成的培训视频、产品介绍或内部知识库视频里,用自己真实声线配音,而不是千篇一律的AI音色,必须通过SVIP权限开通专属语音克隆通道——免费版用户无法看到【Voice Clone】入口,企业邮箱验证通过后系统才解锁该功能。
确认账户与权限状态
打开 https://www.php.cn/link/0f73ede5d16cee6965344290706c986c → 使用Google或Microsoft账号登录 → 点击右上角头像 → 查看账户详情页中“Subscription Tier”是否显示“SVIP Active”。【未显示SVIP则所有后续操作均无效】
若仍为“Free Plan”,需先完成企业邮箱(@company.com)验证:进入Settings → Email Verification → 输入企业邮箱 → 查收邮件点击确认链接。普通Gmail或QQ邮箱无法触发权限升级。
上传高质量语音样本
点击左侧菜单栏【Voice Clone】→ 点击【Upload Sample】按钮 → 选择一段4–6分钟的WAV或MP3文件(采样率16kHz/16bit,无背景音乐、无回声、单人朗读)。
推荐录音方式:用手机备忘录在安静卧室录制,内容包含日常短句(“我们来试试这个功能”)、数字(“2026年9月30日”)、带情绪词(“太方便了!”)、稍长复合句(“如果参数没调对,生成的旁白会跳过关键术语”)。【禁用会议录音、Zoom回放、带电流声的电话录音】——这类音频会导致模型学习错误停顿逻辑,克隆后语音常出现诡异卡顿或吞字。
上传后页面自动显示波形图与语速/音调分析报告,等待右上角提示“Sample validated”即可进入下一步。
生成并测试克隆音色
第一步:在文本框中输入3–5句测试文案,例如:“欢迎使用VibeKnow智能视频平台”“请检查语速设置是否匹配脚本节奏”“这个功能已通过企业级安全审计”。
第二步:点击【Generate Voice】→ 系统后台启动轻量微调,耗时约90秒(不依赖GPU,纯CPU计算)→ 完成后自动播放三段对比音频:原声样本片段、克隆语音、系统默认“Linlin”音色。
第三步:拖动时间轴逐句比对停顿位置与重音分布。若发现“检查”“审计”等词发音含混,说明样本中对应词汇缺失,需补传含该词的新录音片段重新训练。
确认满意后,点击【Save as MyVoice】,该音色将出现在所有Voice Settings的下拉列表顶部,名称为“MyVoice (v1)”。
在视频中启用克隆声线
返回任意已解析文档项目 → 点击【Generate Video】生成初稿 → 进入脚本编辑页 → 点击右上角齿轮图标 → 【Voice Settings】→ 在「Voice」下拉菜单中选择“MyVoice (v1)”。
此时语速滑块默认继承克隆样本原始节奏,无需手动调节;但若原文档含大量技术缩写(如API、SOP、SLA),建议将Speech Speed微调至+5%,避免AI因过度拟合原声语速而漏读字母连写部分。
点击某段右侧播放图标旁的铅笔按钮 → 修改旁白文字 → 按回车 → 系统自动用MyVoice重合成该句,不改变画面时间轴。











