听写专用于语音转文字,语音控制可操作整台mac;听写支持离线与标点插入,语音控制需下载模型且禁用听写功能,二者不可同时运行。
mac 上的听写和语音控制是两个独立但常被混淆的功能:听写专用于“语音转文字”,语音控制则能“用声音操作整台 mac”。配置前需明确用途——只输入文字选听写;要打开 app、点按钮、滚动页面,就得用语音控制。
启用并设置听写功能
听写适合快速录入长文本,支持标点自动插入和离线使用(需下载语言包):
- 打开「系统设置」→「键盘」→「听写」,开启开关
- 点击「语言」下拉菜单,选择所需语言(如“简体中文”或“英语(美国)”);若需离线识别,勾选「增强型听写」并等待语言包下载完成
- 在「快捷键」中设置启动组合键(默认是 Fn 键两次),也可改为其他不冲突的按键组合
- 确保「隐私与安全性」→「麦克风」中已授权「听写与语音输入」权限
- 说话时保持语速平稳,说“逗号”“句号”“新行”等可直接插入格式;识别不准的词会带蓝色下划线,点击可选替代
开启并定制语音控制
语音控制更强大,但会禁用标准听写——两者不可同时运行:
macOS 微信消息自动化工具。通过 GUI 自动化实现:发送消息给指定联系人、读取聊天内容、监控新消息。适用于需要自动化微信操作的场景,如定时发送、批量回复、消息备份等。依赖 peekaboo 进行屏幕截图和 UI 交互。仅支持 macOS。开源地址:https://github.com/chairmanmia...
- 进入「系统设置」→「辅助功能」→「语音控制」,点击「启用语音控制」
- 首次启用需联网下载语音模型(仅一次),完成后麦克风图标出现在屏幕右上角
- 在「语言」中添加或切换语言;支持中文(普通话/粤语)、英文等主流语种,部分语言需单独下载
- 点开「词条」可添加专业词汇(如“PyTorch”“GitHub Actions”),提升识别准确率;支持批量导入文本列表
- 常用命令无需唤醒词:直接说“打开访达”“向下滚动”“显示命令”即可;说“停止听取”暂停,“开始听取”恢复
关键区别与使用提醒
避免误配的关键点:
- 听写只能输入文字,不能操控界面;语音控制既能听写,也能点菜单、切窗口、调音量
- 语音控制开启后,系统自带的「听写」功能自动失效,快捷键也不再响应
- 想完全离线?听写启用「增强型听写」即可;语音控制本身默认离线运行,不上传录音
- 麦克风设备可在各自设置页中单独指定,建议使用降噪效果好的外接麦提升识别率
- 若识别总出错,先检查发音清晰度,再进「词条」补充术语,最后考虑更换语言模型或重置语音数据
调试与优化小技巧
提升日常使用顺滑度:
- 说命令时适当停顿半秒,尤其连续操作如“点按编辑菜单 → 点按粘贴”
- 面对复杂界面,说“显示编号”让每个可点区域标上数字,再报编号快速交互
- 网页中不确定链接名称时,用“显示编号”+“点按 X”比尝试喊出完整标题更可靠
- 在「命令」设置页可查看当前上下文支持的全部指令,比如在 Pages 中会多出“加粗”“插入表格”等
- 定期清理语音缓存:「系统设置」→「辅助功能」→「语音控制」→「高级操作」→「删除所有语音历史」










