通义千问语音输入需按场景、设备和触发方式分路径使用:手机端有点击麦克风图标和长按输入框两种方式,电脑端用快捷键唤醒,网页端需chrome/edge浏览器授权麦克风权限,所有路径均依赖系统录音权限。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

通义千问语音输入不是点一下就能用的固定按钮,而是分场景、分设备、分触发方式的多路径通道——手机端有三种启动入口,电脑端用快捷键唤醒,网页端需浏览器授权,每种都得走对路径才能出声。
手机App内快速语音输入(适合单次提问)
点击输入框右侧的麦克风图标,这是最直接的语音入口,但图标默认灰色,不点不会变蓝,也不自动监听。
1、打开通义千问App,确保已登录,进入任意对话页;
2、找到输入框右端那个带声波图标的麦克风,【必须点击而非长按】,它会立刻变蓝并开始录音;
3、按住说话,松手即发送——如果松手后没反应,大概率是手机系统没给“录音”权限,去设置里补授。
手机端长按输入框语音输入(适合习惯手势操作的人)
这个方式把整个输入框变成语音触发区,不用找图标,但对APP版本有硬性要求。
方法一:长按输入框空白处超过1.5秒→等波形动画出现→保持按住说话→松手自动转文字发送。
方法二:若长按无反应,别反复试,直接去应用商店更新到v6.12.0及以上版本——旧版根本不支持该交互逻辑。
电脑端语音输入(仅限客户端,网页版暂不支持)
从2026年5月7日起,千问电脑版(Windows/Mac)已上线语音输入,支持中英混合识别,但必须装最新客户端,网页版至今没同步。
第一步:确认已安装千问电脑版,版本号不低于5.0.0;
第二步:在任意聊天窗口,按下快捷键——Windows按右Alt键,Mac按右Command键;
第三步:听到提示音后开始说话,松开即完成识别;
第四步:注意该功能全程依赖云端ASR模型,【无网或弱网时完全不可用】,本地不存离线包。
网页端语音输入(Chrome/Edge专属)
网页端只认Web Speech API,且只在Chrome和Edge上稳定可用,Safari和Firefox目前不支持。
1、用Chrome或Edge打开https://tongyi.aliyun.com/qwen;
2、点击输入框右侧麦克风图标;
3、浏览器弹出权限请求时,必须点“允许”,否则后续所有步骤无效;
4、授权后再次点击图标,即可说话转文字——网页版不支持快捷键唤醒,也不支持长按输入框触发。
语音功能失效的终极排查项
前三步全试过仍不能语音,问题一定卡在系统底层权限上。
安卓用户:进【设置】→【应用管理】→【千问】→【权限管理】→确保“录音”“存储”“后台弹出界面”三项全开,再检查【电池优化】列表里千问是否被限制后台运行;
iOS用户:进【设置】→【隐私与安全性】→【麦克风】→打开千问开关,【缺一不可】。











