通义听悟支持实时录音转文字和本地音频文件上传转写,手机app可边说边出字,网页端上传mp3等格式文件后自动处理,转写完成可编辑、复制、导出txt/word/pdf,免费无水印。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你需要把会议、网课或访谈录音快速变成可编辑的文字稿,通义听悟能直接在手机或电脑上完成实时转写,不用等文件上传、不用手动切分段落,边说边出字。
手机App里开启实时录音转文字
打开通义听悟App,首页底部导航栏点击【实时语音转文字】。
点击红色圆形【开始录音】按钮,设备立刻收音并同步显示识别结果;说话时保持距离麦克风15–30厘米,语速平稳,避免多人同时抢话——否则系统可能无法准确区分说话人。
录音结束点【停止】,文字自动锁定不可再追加,此时可立即编辑错别字或补充漏记内容。
这一步操作起来很简单,直接把文件拖进去就行。
网页端上传本地音频文件转写
方法一:浏览器访问 https://tingwu.aliyun.com/home → 用支付宝/淘宝账号扫码登录 → 点击【上传音视频】→ 选择MP3、M4A、MP4等格式的本地文件(单个最长2小时)→ 点击【开始转写】。
方法二:若已录好但未保存为文件,可用手机系统自带录音机录完后通过微信或数据线传到电脑,再上传。注意不要用第三方压缩工具二次处理音频,【原始采样率低于16kHz会导致识别断续、人名和术语大量出错】。
上传后页面自动跳转至任务队列,状态变为“处理中”即开始转写,通常1小时音频约耗时5分钟。
转写完成后提取和导出文字
第一步:在“历史记录”列表找到刚完成的条目,点击进入详情页。
第二步:全文默认按说话人分段,左侧是摘要+待办清单+关键词,右侧是带时间戳的逐字稿;如需复制某一段,长按文字区域调出系统选择框,选中后点【复制】。
第三步:点击右上角【导出】按钮 → 选择导出格式(TXT/Word/PDF)→ 勾选是否包含时间轴、发言人标签、摘要等内容 → 点击【导出到本地】。
基础导出永久免费,不限次数,不加水印,也不限制单次导出字数。











