qclaw结合本地whisper模型实现离线语音转文字,无需联网、保护隐私;安装whisper技能并重启主程序是前提,支持微信发语音+指令、上传文件批量识别及语音收件箱自动归类。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你想把手机录的会议语音、采访片段或课堂录音,直接在电脑上转成文字,全程不联网、不上传、不担心隐私泄露——QClaw 结合本地 Whisper 模型就能做到。它不需要你懂 Python,不用配环境变量,解压即用,识别结果自动写入指定文件,连保存路径都能一句话指定。
安装 Whisper 技能并启用本地识别能力
这一步是整个流程的基础,没装好技能,后续所有指令都会返回“未识别该功能”。
打开浏览器,访问 SkillHub 官方地址:https://skillhub.tencent.com/#featured。
在搜索框输入“Openai Whisper”,找到官方标注「本地离线语音转文本」的技能卡片,点击「一键安装」。
安装过程自动走国内高速镜像,通常 10 秒内完成,无需手动解压或复制文件到 QClaw 目录。
【安装完成后必须重启 QClaw 主程序】——否则微信向“龙虾”发送的任何识别指令都不会被响应。
通过微信“龙虾”好友直发语音转文字
适合 60 秒以内、语速清晰、背景安静的语音片段,比如临时口述待办事项、快速记录灵感、简短会议要点。
方法一:实时语音+指令组合发送
第一步:在微信中打开与“龙虾”的聊天窗口,确认其头像右下角显示绿色在线标识。
第二步:长按输入框右侧麦克风图标,录制一段 ≤60 秒的语音,松手后立即发送。
第三步:紧跟着发送一条纯文字消息,格式为:转文字,存为D:\QClaw\今日速记.txt(路径可自定义,但必须含完整盘符和 .txt 后缀)。
第四步:等待 3–8 秒,QClaw 自动调用本地 Whisper 引擎完成识别,文件即时生成。若超过 10 秒无反应,检查是否已重启主程序。
方法二:发语音后单独触发识别
先发送语音,等 2 秒后再发文字指令:识别上一条语音,输出到D:\QClaw\草稿\临时记录.md。
这个方式允许你发完语音再思考保存路径和格式,但注意:上一条必须是语音,不能是图片或文字,否则会报错“未检测到可识别语音”。
上传音频文件后批量识别
适用于长录音(超 60 秒)、带背景音乐/多人交谈/方言较重的场景,精度更高,且保留原始音频便于复核。
用手机录音 App 录制后,导出为 .m4a(iOS)或 .wav(Android 推荐) 格式,避免使用压缩率过高的 .mp3。
通过 QQ 浏览器「跨屏穿越」功能,将文件一键发送至电脑端默认下载目录(通常是 D:\Downloads)。
在微信中向“龙虾”发送指令:识别D:\Downloads\会议_20260618.m4a,输出到D:\QClaw\整理\正式纪要.txt。
QClaw 会立刻校验文件是否存在、格式是否支持;若路径错误或文件被占用,会返回具体提示,比如“找不到该文件”或“正在被其他程序使用,请关闭音频播放器后重试”。
开启语音收件箱实现自动归类转写
如果你每天都要处理多段语音,又希望按日期、主题自动分类,这个模式能省去每次输路径的麻烦。
向“龙虾”发送文字:开启语音收件箱。
QClaw 自动创建 D:\QClaw\VoiceInbox 文件夹,并返回一个动态二维码。
用手机 QQ 浏览器扫描该码,进入上传页,选择语音文件提交——上传成功后,QClaw 会在 5 秒内自动执行 Whisper 识别,并将结果存入 D:\QClaw\VoiceInbox\20260618\152347.txt(含时间戳)。
下次再发“开启语音收件箱”,旧二维码失效,新码绑定最新路径,【旧收件箱不会被清空,但新上传只进新目录】。











