讯飞智作ai语音生成支持网页端免安装操作,基于星火大模型与tts 3.0引擎,可实现中英混读、12种方言及多情感调节;需登录zuozuo.xunfei.cn后进入「ai+音频」模块,选择合适发音人,调节语速(0.95~1.05)、语调(如权威类-4、日常类+1)并插入全角停顿标记,最后点击【立即生成】下载mp3。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

想用讯飞智作快速生成一段自然、带情绪的AI语音,不用下载软件、不装插件,网页打开就能输入文案出声——这正是讯飞智作AI语音生成的核心能力,它基于星火大模型与TTS 3.0合成引擎,支持中英混读、12种方言及多情感语调调节。
网页端登录与基础入口定位
打开浏览器,访问 https://zuozuo.xunfei.cn → 点击右上角【登录】→ 使用讯飞账号或手机号一键登录(未注册可直接手机号快捷注册)。
登录成功后,首页默认进入「AI+音频」工作台;若页面跳转至虚拟人视频界面,需手动点击顶部导航栏的【AI+音频】标签切换回来——【必须在此模块操作,其他入口无法调用纯语音生成功能】。
输入文案并选择发音人
在文本输入框中粘贴或手写配音文案(建议单次不超过800字,超长易触发分段合成异常)。
下方「发音人」下拉菜单中,中文优先选「云扬」「晓燕」「星然」:云扬沉稳适合企业宣传,晓燕明亮适配教育口播,星然带轻微呼吸感更接近真人主播;英文内容请选择「Emily」「James」等原生音色,避免用中文音色强行读英文造成断句错乱。
注意:部分音色标注「精品」或「声音复刻」字样,这类需单独开通权限或已上传过声纹样本才能启用,普通用户首次使用请避开此类选项。
关键参数调节(决定是否像真人播音)
第一步:拖动「语速」滑块至0.95~1.05区间——低于0.85会拖沓呆板,高于1.15则咬字模糊、丢失广告播音所需的颗粒感。
第二步:点击「高级设置」展开面板 → 在「语调」栏输入数值:权威类内容填-4,日常推广类填+1,儿童内容填+3;不要留空,默认值会导致声音发平。
第三步:在文案中手动插入停顿标记。例如:“全新升级净水器[停顿0.3秒][重音]四重过滤系统”,方括号必须全角,数字单位必须是“秒”,不能写“s”或“S”。这一步直接影响节奏呼吸感,漏掉就只剩机器朗读味。
生成与导出音频文件
确认所有设置无误后,点击右侧绿色【立即生成】按钮。
等待约8~15秒(取决于文案长度),页面弹出预览播放器 → 点击 ▶ 按钮试听效果。
满意后点击【下载MP3】,文件自动保存至电脑默认下载目录,命名含时间戳与发音人名,如“20260819_云扬_产品介绍.mp3”。











