需先完成网络配置、账号注册、入口进入、音频上传与训练启动五步流程。海外网络访问官网,用国际邮箱注册获配额,点击voices进入克隆页,上传15–300秒干净音频并设参数,最后点击convert等待ready状态。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

如果您希望在Minimax平台启用语音克隆功能并完成声音定制,需先完成平台访问、身份认证与服务入口激活。以下是开通与定制的详细流程:
一、网络环境配置与官网访问
Minimax语音克隆服务当前仅对海外用户开放,国内用户需确保网络环境可稳定加载国际域名资源,避免页面元素缺失或功能按钮不可点击。该步骤是后续所有操作的前提,未完成将无法进入Voices模块。
1、使用Chrome浏览器,通过稳定网络环境访问官方地址:https://www.minimax.io/audio。
2、若页面加载异常或提示“Access Denied”,请切换网络工具节点至欧美地区,并清空浏览器缓存后重试。
3、确认页面右上角显示“Sign In”按钮且可正常点击,即表示网络通路已就绪。
二、账号注册与初始权限获取
系统通过邮箱绑定识别用户身份,并依据注册渠道自动分配基础资源配额,包括声贝额度与免费克隆次数。使用非国内主流邮箱(如Gmail、Outlook)可避免验证失败或权限受限。
1、点击右上角“Sign In”,选择“Create Account”。务必使用Gmail或Outlook等国际邮箱注册。
2、填写邮箱、设置密码,完成图形验证码与邮箱验证流程。
3、登录成功后,检查账户仪表盘是否显示10000声贝及3次免费Voice Clone机会,该信息位于首页右上角头像下拉菜单中“Billing & Usage”项内。
三、进入语音克隆功能入口
Voices模块为语音克隆唯一操作界面,其路径固定且不随账号类型变化。未在导航栏中看到该选项,通常意味着登录未生效或页面未完全加载。
1、登录后,观察左侧垂直导航栏,定位并点击“Voices”文字链接。
2、页面右侧区域将显示主操作面板,查找并点击“Create your Voice Clone”蓝色按钮。
MiniMax 3.0.18 是一款高效、轻量级的系统优化与多媒体增强工具。该版本在核心性能上进一步升级,提供更稳定的运行环境与更低的资源占用。主要功能包括智能内存管理、启动项优化、网络加速及高清音视频解码增强,显著提升设备响应速度与影音体验。新版修复了已知兼容性问题,并优化了界面交互逻辑,适用于日常办公与娱乐场景。MiniMax 3.0.18 秉承简洁实用的设计理念,帮助用户轻松维护系统健康,提升整体使用效率。
3、此时页面跳转至上传界面,URL应包含/voices/clone路径片段,表明已成功进入克隆功能域。
四、音频样本上传与预处理设置
上传环节直接决定克隆音色的声纹保真度与情绪还原能力。系统对音频时长、格式、信噪比有硬性校验逻辑,不符合条件的文件将被拒绝上传或生成失败。
1、准备一段时长15–300秒、单一人声、无背景音乐与回声的MP3或WAV文件,采样率不低于16kHz。
2、点击上传区域虚线框,从本地选取音频;或点击“Record”按钮现场录制——录制时需保持环境绝对安静,麦克风距口部20cm左右。
3、勾选“Remove Background Noise”启用自动降噪,该选项对非录音棚环境下的样本尤为关键。
4、在命名栏输入音色标识,推荐格式为“张三_20260403”,便于后期多音色管理。
5、在语言下拉菜单中选择与录音一致的语种,如Chinese (Mandarin),不可错选方言或相近语种。
五、克隆训练启动与状态确认
系统调用Speech-02-hd模型进行端到端声纹建模,训练过程为全自动异步任务,无需人工干预。状态栏实时反馈进度,失败时会明确提示原因而非静默终止。
1、核对所有参数无误后,点击“Convert”按钮启动训练。
2、等待界面出现绿色对勾图标及“Ready”状态标签,通常耗时20–60秒,期间勿刷新或关闭页面。
3、返回“My Voices”列表,确认新音色条目右侧状态显示为“Ready”,且可点击“Use”跳转至TTS合成页。










