使用 Python edge‑tts 将文本转为语音,支持多种语音、语言、语速调节、音调控制以及子...
Edge-TTS Skill.是一项面向实际任务的技能,主要用于Overview.;Generate 高质量文本对语音音频,使用微软Edge的神经TTS服务通过Python 边缘Tts. 支持多种语言,语音,可调速/pitch, an。
从功能定位来看,该技能强调把分散的操作要求整理成清晰、可复用的处理流程,使用户能够围绕既定目标快速准备输入、选择执行方式并获得结构化结果。实际使用前应先确认任务范围、数据来源、运行环境、必要权限和关键参数,再依据技能说明逐步执行;
若输入条件不完整,应先补齐信息或采用保守配置,避免因错误假设导致结果偏离需求。执行过程中需要关注工具调用是否成功、接口或依赖是否可用、输出格式是否符合预期,并对异常提示、缺失字段和边界情况进行处理;涉及批量任务时,还应保存进度,避免中断后重复操作。
通过 Python 库 edge-tts 调用 Microsoft Edge 的神经网络 TTS 服务,生成高质量的文本转语音(TTS)音频。支持多种语言与音色、可调节语速/音调,并支持字幕文件生成(SRT/VTT 格式)。
当从触发词或用户请求中检测到 TTS 意图时:
将文本中出现的 "tts" 关键字识别为 TTS 请求。本技能会在转换前自动过滤掉文本中与 TTS 相关的关键词。
如需更精细的控制,可直接运行随附的脚本:
cd scripts
python3 tts_converter.py "Your text" --voice en-US-AriaNeural --rate +10% -o output.mp3
python3 tts_converter.py -f input.txt --voice zh-CN-XiaoxiaoNeural -o output.mp3
python3 tts_converter.py -f input.txt -v zh-CN-YunxiNeural -r "+10%" -o output.mp3 -s output.vtt
可用参数:
--voice, -v:音色名称(默认值:en-US-MichelleNeural)--lang, -l:语言代码(例如:en-US、zh-CN)--rate, -r:语速调整(例如:+10%、-20%)--volume:音量调整(例如:+0%、-50%)--pitch:音调调整(例如:+0Hz、-10Hz)--output, -o:输出文件路径(默认:临时文件)--subtitles, -s:将字幕保存至文件(支持 .vtt 或 .srt 格式)--file, -f:从文件读取待转换文本--proxy, -p:代理 URL--timeout:接收超时时间(单位:秒,默认值:60)--list-voices, -L:列出所有可用音色--lang-filter:按语言筛选音色(需配合 --list-voices 使用)cd scripts
python3 config_manager.py --set voice zh-CN-XiaoxiaoNeural
python3 config_manager.py --set rate "+10%"
python3 config_manager.py --get
python3 config_manager.py --reset
常用音色(完整列表请运行 --list-voices):
英语:
en-US-MichelleNeural(女声,自然流畅,默认音色)en-US-AriaNeural(女声,自然流畅)en-US-GuyNeural(男声,自然流畅)en-GB-SoniaNeural(女声,英式口音)en-GB-RyanNeural(男声,英式口音)中文:
zh-CN-XiaoxiaoNeural(女声)zh-CN-YunyangNeural(男声,新闻播报风格)zh-CN-YunxiNeural(男声,自然流畅)其他语言:
es-ES-ElviraNeural(西班牙语)fr-FR-DeniseNeural(法语)de-DE-KatjaNeural(德语)ja-JP-NanamiNeural(日语)ar-SA-ZariyahNeural(阿拉伯语)语速值采用百分比格式:
"+0%":正常语速(默认)"-20%" 至 "-10%":偏慢、清晰(适用于教程、故事朗读、无障碍场景)"+10%" 至 "+20%":略快(适用于摘要类内容)"+30%" 至 "+50%":较快(适用于新闻播报、效率优先场景)主 TTS 转换脚本,基于 edge-tts 实现。支持自定义音色、语速、音量、音调;支持生成 VTT/SRT 字幕;支持音色列表查询。
用于管理用户持久化的 TTS 配置偏好,配置文件存储于 ~/.tts-config.json。
可在以下网址试听不同音色并预览音频质量:https://tts.travisvn.com/
pip install edge-tts
"tts" 触发词或相关关键词tts 工具;对需定制化需求则使用 scripts/tts_converter.pycd scripts
python3 tts_converter.py "Hello, this is a test." -o test-output.mp3
python3 tts_converter.py "这是一个测试" -v zh-CN-XiaoxiaoNeural -o test-zh.mp3
python3 tts_converter.py --list-voices --lang-filter zh
python3 config_manager.py --get
python3 config_manager.py --set voice en-US-GuyNeural
python3 config_manager.py --get voice
edge-tts 调用的是 Microsoft Edge 提供的在线 TTS 服务--output 显式指定自定义输出路径。Neural 结尾的音色为神经网络合成音色,音质更优相关专题
热门下载
相关下载
精品课程
共6课时 | 54.6万人学习
共89课时 | 133.1万人学习
共49课时 | 82万人学习