windows 11内置离线语音听写支持本地录音转文字,需满足22h2+中文语言包,启用“设备上”语音识别模型并关闭云端选项,再通过win+h→“从文件听写”导入wav/mp3完成全程离线转写。

你需要把会议录音、访谈音频或讲课内容快速转成准确文字稿,又不想依赖第三方软件或网络上传——Windows 11 内置的语音听写功能其实已支持离线录音转写,但默认关闭且路径隐蔽,必须手动启用系统级语音模型与本地语音识别服务。
确认系统版本与语言包是否就绪
打开「设置」→「系统」→「声音」→ 滚动到底部点击「语音访问」右侧的「更多设置」链接→ 页面跳转后检查「语音识别」区域是否显示“已安装”;若显示“下载”按钮,点击它并等待完成——【必须使用 Windows 11 22H2 或更新版本,且系统语言设为中文(简体,中国)】,否则后续步骤无法触发本地语音模型加载。
这一步不能跳过。旧版系统或语言不匹配时,即使开启听写,也会强制走云端识别,延迟高、断网即失效、长音频易中断。
启用语音听写并切换至离线模式
方法一:快捷键直启
按 Win + H,首次会弹出权限引导页,勾选「允许此应用访问你的麦克风」→ 点击「是」→ 出现浮动听写栏后,点击右下角齿轮图标→ 关闭「使用云语音识别」开关。
方法二:通过设置深层开启
「设置」→「辅助功能」→「语音」→ 开启「语音听写」→ 向下滚动到「高级语音选项」→ 点击「语音识别模型」→ 选择「设备上(离线)」→ 等待进度条走完(约1–3分钟,后台下载约180MB本地模型)。
注意:关闭「使用云语音识别」后,浮动栏左上角会显示灰色“离线”字样,此时才真正调用本地AI模型。开着这个开关等于白做。
导入录音文件并启动精准转写
第一步:准备WAV或MP3格式音频文件,时长建议单次不超过90分钟,采样率44.1kHz、单声道效果最佳。
第二步:打开任意可编辑文本区域(如记事本、Word、OneNote),确保光标处于可输入状态。
第三步:按 Win + H 唤出听写栏→ 点击栏内「…」→ 选择「从文件听写」→ 浏览并选中你的音频文件→ 点击「打开」。
第四步:系统开始加载音频波形图,几秒后自动进入转写状态;进度条走完即生成文字,无需手动暂停或分段。
该过程全程离线运行,不上传任何音频片段。若音频含大量专业术语或口音较重,可在转写前先在「设置」→「语音」→「语音听写词典」中添加自定义词汇,提升专有名词识别率。











