必须升级svip并验证企业邮箱才能启用声音克隆功能;登录后检查账户等级为svip,通过settings绑定企业邮箱;进入create video上传任意文档触发功能,再通过+ add feature选择voice clone;上传4–5分钟干净人声录音,生成试听音频确认无失真后保存声纹。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

想在VibeKnow中使用自己的声音为培训视频、产品说明或内部 SOP 配音,必须先开通声音克隆权限——该功能不在免费版首页入口可见,注册后需完成企业邮箱验证并升级至SVIP才能启用,否则所有相关选项均处于隐藏状态。
确认账户已具备克隆权限
打开 https://vibeknow.com → 使用 Google 或 Microsoft 账号登录 → 点击右上角头像 → 查看账户信息页中的「Subscription Tier」是否显示 “SVIP”;若显示 “Free” 或 “Trial”,则【尚未开通声音克隆权限,后续所有操作都将失败】。
前往 Settings → Account → Verify Business Email → 输入以 @company.com / @org.cn 等结尾的企业邮箱 → 查收验证邮件并点击链接完成绑定 → 页面自动刷新后,SVIP 标识出现即代表权限就绪。
进入Voice Clone功能入口
返回首页 → 点击顶部导航栏「Create Video」→ 上传任意 DOCX/PDF 文件(仅用于触发功能加载,无需真实内容)→ 等待右上角“Processing…”消失、左侧出现结构化脚本 → 此时点击左下角悬浮按钮「+ Add Feature」→ 在弹出菜单中选择「Voice Clone」。
注意:若未完成企业邮箱验证,该菜单中不会出现「Voice Clone」选项,也不会有任何报错提示——系统直接过滤掉该条目。
上传语音样本并生成声纹
第一步:准备一段 4–5 分钟的干净人声录音 → 使用手机自带录音 App,在安静房间内朗读包含数字、短句、长句和自然停顿的文本(如:“第三步,请核对API密钥。2026年9月30日。这个配置会影响全部子模块。”)→ 导出为 WAV 或 MP3 格式,大小控制在 50MB 内。
第二步:在 Voice Clone 页面点击「Upload Sample」→ 拖入音频文件 → 系统自动分析音色特征并显示语速、基频范围与高频词统计(如“检测到高频词:我们、请、确认、参数”)。
第三步:输入一段 30 字以内的测试文本 → 点击「Generate Voice」→ 约 90 秒后生成试听音频 → 若语音自然、无断字或失真,点击「Save as My Voice」即完成声纹入库。
这一步不可跳过:若上传的是会议录音、带背景音乐或多人对话的音频,模型将无法提取稳定声纹,生成结果会出现明显杂音或跳频,且【无法二次上传覆盖,必须新建克隆任务】。











