必须使用国际版(minimax.io/audio)才能克隆声音,国内版仅支持tts;需科学上网、邮箱登录,成功后左上角显示“hailuo ai audio (international)”;手机端可直接录音或上传音频克隆,tts中需手动选择音色、调节语速与情绪强度,并用「」添加气口,导出时选wav格式获高保真音质。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

想用海螺AI Audio把文字变成自然人声、克隆自己声音、或给短视频配情绪化旁白,必须先区分国内版与国际版功能边界——国内版(hailuoai.com/audio)仅提供TTS文本转语音,无音色克隆;国际版(minimax.io/audio)才支持声音克隆与高精度参数微调,且需科学上网并用邮箱登录。
确认使用版本与登录方式
打开浏览器,访问 https://www.php.cn/link/a04675fb5b7df417aba1a8ee1cb80d56 → 点击右上角“Login” → 使用Gmail、Outlook等邮箱注册/登录 → 登录后页面左上角显示“Hailuo AI Audio (International)”即为正确入口。若误入国内版(minimaxi.com/audio 或 hailuoai.com/audio),将看不到「Voices」标签和「Create Voice Clone」按钮,无法进行音色克隆。
【国内版不支持克隆音色,所有尝试上传音频或点击克隆按钮的操作均无效】
手机端快速克隆你的声音
方法一:直接录制(推荐新手)
打开海螺AI国际版App → 点击底部「Audio」→ 进入「Voices」→ 点击「Create Voice Clone」→ 点击麦克风图标开始录音 → 用自然语调朗读“今天阳光很好,风吹树叶沙沙响”等含元音、辅音、语调变化的30秒句子 → 录完立即点击「Convert」。
方法二:上传音频文件
确保已有MP3/WAV格式人声片段(10–60秒,无背景音乐、无混响)→ 在「Create Voice Clone」页点击「Upload Audio」→ 选择文件 →【务必关闭“Remove Background Noise”除非音频明显嘈杂,否则降噪会削弱声音个性特征】→ 点击「Convert」。
注意:国内版无此功能,必须使用国际版,且需科学上网环境登录邮箱账号。
在TTS中调用并优化克隆音色
第一步:进入语音生成界面
克隆成功后自动跳转至「Text to Speech」页,或手动从底部导航栏进入。
第二步:绑定克隆音色
在右侧声音列表中找到你刚创建的名字(如“MyVoice_01”)→ 点击选中 → 此时输入框上方会显示该音色已激活。
第三步:设置基础参数
语速调至0.9–1.1之间最接近真人呼吸节奏;音量保持默认即可;【情绪选项必须手动切换,不选则为中性语调,无法体现歌唱感】。
第四步:插入停顿增强韵律
在歌词换气处添加「」实现半秒气口,例如:“春风拂面柳枝轻摇”,避免机械连读。
第五步:语言与情绪组合控制
在歌词中明确标注语言,如:“爱是light,也是暗涌”,系统将自动切换中文/英文发音引擎,避免“中式英语”腔调;选“兴奋”情绪后,拖动「Emotion Intensity」滑块至60%:语调上扬自然、节奏略快但不急促;若拉到100%,易出现失真破音,尤其高音区。
桌面端导出高保真音频
在「Text to Speech」页完成参数设置后 → 点击右下角「Generate」→ 生成完成后,点击下载图标 → 默认输出为MP3(128kbps);若需专业级音质,点击齿轮图标 → 开启「Advanced Export」→ 将格式切换为WAV → 设置采样率48kHz、位深度24bit → 再次点击「Export」。
【WAV文件体积较大,但保留完整频响与动态细节,适用于后期混音或平台投稿】











