必须通过svip权限开通专属语音克隆通道;免费版用户点击【voice clone】会跳转企业邮箱验证页,未验证则功能不可见;svip需用@company.com或@org.edu邮箱验证,验证后90秒内显示“voice clone ready”;上传4–6分钟无背景音样本或使用live采样,需含数字句、疑问句及30秒自然语流;命名模型≤12字符无空格,cloning fidelity设85%–92%,可选context-aware prosody;生成耗时约2分17秒。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

想在VibeKnow中复刻自己的声音用于培训视频或产品讲解,必须通过SVIP权限开通专属语音克隆通道——免费版用户点击【Voice Clone】入口会直接跳转至企业邮箱验证页,未完成验证则所有克隆功能不可见、不可用。
确认SVIP权限已激活
打开 https://vibeknow.com → 使用Google或Microsoft账号登录 → 点击右上角头像 → 查看账户状态栏是否显示“SVIP Active”及到期时间。若显示“Upgrade to SVIP”或空白,需先完成企业邮箱(@company.com 或 @org.edu)验证;【仅个人邮箱(如@gmail.com)无法触发克隆模块加载】。
验证路径:账户设置 → Email Verification → 输入企业邮箱 → 查收验证码邮件(注意检查垃圾箱)→ 粘贴6位码提交。系统约90秒内自动刷新权限状态,此时页面左下角会出现浮动提示“Voice Clone ready”。
上传语音样本并启动克隆
方法一:网页端一键上传
点击左侧菜单栏【Voice Clone】→ 在弹出面板中点击“Upload Sample”按钮 → 选择一段时长4–6分钟、无背景音乐、单人清晰朗读的WAV或MP3文件(推荐使用手机录音APP在安静房间录制,避免会议录音或电话录音)。【样本中必须包含至少3个带数字的句子(如“第二步是点击右上角齿轮图标”)、2处升调疑问句(如“你确认要删除吗?”)和1段连续30秒以上的自然语流】。
方法二:自动采样生成(仅限SVIP新用户首测)
点击【Record Live Sample】→ 允许麦克风权限 → 按屏幕提示朗读三段系统随机生成的短句(每段间隔2秒),全程约90秒 → 点击“Submit & Analyze”。该方式生成的样本不支持手动编辑,但跳过格式校验环节,5分钟内即可进入建模。
配置克隆参数并生成音色
第一步:命名你的声音模型
在“Voice Name”输入框中填写不超过12个字符的名称(如“ZhangTech”“LiuTrainer”),不能含空格或特殊符号,否则后续TTS调用失败。
第二步:选择声学特征强度
拖动“Cloning Fidelity”滑块:设为85%~92%适用于通用教学场景,保留自然气口又规避过度拟真带来的机械感;拉到100%会导致部分连读失真,尤其在“了”“的”“啊”等轻声词上出现延迟卡顿。
第三步:启用语境适配(可选)
勾选“Context-Aware Prosody”,系统将自动分析你上传样本中的停顿分布与重音模式,并映射到后续TTS文本中。此选项对SOP操作类脚本提升显著,但会使首次生成耗时增加40秒左右。
点击“Generate Voice”按钮 → 等待进度条走完(通常2分17秒)→ 页面弹出“Voice Ready: ZhangTech”提示,右侧出现试听播放键和“Apply to Script”按钮。











