调用 MiniMax 语音合成 API 生成语音,支持系统音色、克隆音色、流式/非流式输出。适用于高质量中文语音合成、文本转语音场景。
MiniMax TTS Skill是一项面向实际任务的技能,主要用于调用 MiniMax TTS API 生成语音和发送;要转语音的文本;
注意:如果需要转换的文字太长,可以分成多次生成;channel;matrix,telegram,whatsapp,discord,irc,googlechat,slack。它将相关步骤、工具调用和结果整理方式集中到统一流程中,帮助使用者更快完成目标并减少重复操作。从功能定位来看,该技能强调把分散的操作要求整理成清晰、可复用的处理流程,使用户能够围绕既定目标快速准备输入、选择执行方式并获得结构化结果。
实际使用前应先确认任务范围、数据来源、运行环境、必要权限和关键参数,再依据技能说明逐步执行;若输入条件不完整,应先补齐信息或采用保守配置,避免因错误假设导致结果偏离需求。执行过程中需要关注工具调用是否成功、接口或依赖是否可用、输出格式是否符合预期,并对异常提示、缺失字段和边界情况进行处理;涉及批量任务时,还应保存进度,避免中断后重复操作。该技能适合用于一次性任务,也可以接入自动化工作流,与其他技能或上层代理配合完成更完整的业务链路;在组合使用时,应明确每一步的输入输出关系,并避免不同步骤之间出现参数冲突。
调用 MiniMax TTS API 生成语音和发送。
# 指定音色和模型 python3 ~/skills/minimax-tts/scripts/tts.py "你好世界" --voice "female-shaonv"
| 参数 | 说明 | 默认值 |
|---|---|---|
--text |
要转语音的文本 | 必填 |
--voice |
音色ID | wumei_yujie |
--format |
音频格式 | mp3 |
注意:如果需要转换的文字太长,可以分成多次生成。
openclaw message send --channel telegram --target "xxxxxxx" --media /home/eric/.openclaw/workspace/audio/audio.mp3 -m "语音"
| 参数 | 说明 | 默认值 |
|---|---|---|
--channel |
matrix,telegram,whatsapp,discord,irc,googlechat,slack,signal,imessage,line,feishu,nostr,msteams,mattermost | |
--target |
目标比如xxxxxxx | 必填 |
--media |
媒体文件路径 | 必填 |
给用户发消息的时候,不需要告诉用户你是什么音色等。
调用 get_voice API 获取当前账号下所有音色:
python3 ~/skills/minimax-tts/scripts/tts.py --list-voices
常见系统音色:
female-shaonv - 少女音色female-yujie - 御姐音色wumei_yujie - 妩媚御姐diadia_xuemei - 嗲嗲学妹Chinese (Mandarin)_Sweet_Lady - 甜美女声Chinese (Mandarin)_Soft_Girl - 软软女孩相关专题
热门下载
相关下载
精品课程
共1课时 | 523人学习
共0课时 | 0人学习
共1课时 | 193人学习