mac用户可用系统原生“实时字幕”边播边生成字幕,需apple芯片+macos monterey 12.0+,开启路径为系统设置→辅助功能→实时字幕;或用quicktime导出.m4a音频后通过语音听写导入转写;还可微信提词匠小程序免安装上传视频直接转文字。

Mac用户需要为没有内置字幕的课程录像、会议回放或采访视频生成可读字幕,尤其当人声夹杂在环境音中时,必须依赖系统原生能力分离语音并实时转写——这要求设备搭载Apple芯片、系统为macOS Monterey 12.0或更新版本,且不能直接拖入视频文件操作。
用“实时字幕”边播边生成字幕
这是唯一能真正“实时”响应视频播放进度、无需预处理音频、不上传隐私数据的方法,适用于Safari网页视频、QuickTime本地播放、Zoom回放等所有系统级音频流。
1、点击左上角苹果图标→选择“系统设置”→左侧边栏点“辅助功能”→向下滚动找到并点开“实时字幕”。
2、开启右侧开关;首次启用时系统会自动下载中文语音识别模型,需等待几分钟完成(进度条消失即就绪)。
3、播放目标视频:可在QuickTime中打开本地视频→按空格键开始播放→屏幕底部立即浮现出滚动字幕;若无反应,检查菜单栏右上角是否出现气泡图标,点击它→选“开始实时字幕”。
【关键前提】Intel芯片Mac完全不支持此功能,仅Apple芯片(M1/M2/M3/M4及更新)可用。
用语音听写导入已提取的音频
当视频背景噪音大、多人对话穿插、或需对转写结果逐句校对时,该方法更可控。它绕过实时限制,把音频作为静态文件交给系统听写引擎处理,识别准确率更高。
方法一:QuickTime导出纯音频再导入
在访达中右键点击视频→“用QuickTime Player打开”→按Command+U→选“仅音频”→保存为.m4a格式(默认存到“下载”文件夹)。
打开“备忘录”或“文本编辑”,把光标放在空白处→连按两次Fn键(部分Mac需设为Fn+Option+空格,可在“系统设置→键盘→听写”中确认)→顶部出现蓝色麦克风图标→点击右侧⚙️→“导入音频文件”→选中刚导出的.m4a→点“打开”。
方法二:跳过QuickTime,用终端命令行快速提取(适合批量处理)
打开“终端”,输入:ffmpeg -i /路径/到/视频.mp4 -vn -acodec copy /路径/导出/音频.m4a(需提前安装ffmpeg,用Homebrew执行brew install ffmpeg即可)。
注意:导入后系统不会自动分段,长音频(超30分钟)可能出现识别延迟或断句不准,建议优先切分成10分钟以内片段再分别导入。
用微信提词匠小程序免安装转写
如果你手头只有手机、或Mac上无法启用实时字幕(比如系统版本太旧)、又不想折腾音频提取,这个方案最快——上传视频后5秒内出文字,还带自动标点和断句。
第一步:微信搜索「提词匠」→点击官方小程序→无需注册、无需授权手机号,直接进入主界面。
第二步:点“上传视频”→从相册或文件管理器选取目标视频(支持MP4/MOV/AVI/MKV等8种格式)→确认提交。
第三步:等待几秒→文字自动生成并显示在页面上→可直接复制、一键导出TXT/Word/SRT格式,所有内容无水印。
这一步操作起来很简单,直接把文件拖进去就行。但要注意:小程序处理的是视频文件整体,若原始视频里人声被严重压低(如BGM音量远超说话声),识别效果会明显下降,此时应先用Audacity等工具单独增强人声再上传。











