deepseek需先经asr转写和人工清洗文本才能结构化提炼:必须用whisper或讯飞听见转录并区分说话人,导出纯文本后删除时间戳、合并短句、统一发言人格式、修正错字,再用四段式提示词约束输出,待办项须含可执行动词和完整日期。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

用 Whisper 或讯飞听见完成高精度转写
会议录音不能直接丢给 DeepSeek,它没音频接口。你得先用专业 ASR 工具生成初稿:常见错误现象:直接上传 MP3 到 DeepSeek 界面,提示“不支持该文件类型”或静默失败
使用场景:线下会议录音(WAV/MP3)、线上会议录屏音频(需先提取音轨)
- 优先选
Whisper-large-v3(本地部署,隐私可控)或讯飞听见(中文专精,支持说话人分离) - 务必开启“区分说话人”和“过滤语气词”,否则后续无法准确定位谁说了什么
- 导出格式选纯文本(TXT),不要 SRT 或带时间戳的 JSON——DeepSeek 对时间戳无解析能力,反而干扰语义识别
人工清洗文本是不可跳过的一步
ASR 输出常含大量碎片句、重复段、错别字,DeepSeek 会照单全收并放大错误:常见错误现象:“张经理说:‘这个…呃…我们下周看一下’ → 模型误判为【行动项】‘下周看一下’,却漏掉‘由张经理负责’”
关键清洗动作:
统一LLM网关 - 一个API对接70+AI模型,使用单一API密钥即可调用GPT、Claude、Gemini、Qwen、Deepseek、Grok等主流模型。
- 删除所有
[00:12:34]类时间戳(正则替换:\[\d{2}:\d{2}:\d{2}\]) - 合并同一人连续发言的短句,例如把“嗯。”“我觉得…”“可以试试。”合成一句通顺表达
- 统一标注发言人,格式严格为
[张经理]、[李工](注意中括号+无空格),避免张经理:或(张经理)等变体 - 修正明显错字:如
“实施”→“适时”、“ROI”→“罗伊”,尤其技术术语和人名
用结构化提示词锁定输出格式
自由提问如“请总结会议内容”会导致模型自由发挥,重点模糊、要素缺失:使用场景:需要快速生成可执行待办清单、向老板同步结论、同步给法务审核条款
实操建议:
- 强制要求四段式输出:
①会议基本信息、②核心议题(≤3个)、③每议题下分【讨论要点】【达成结论】【待办事项(含责任人+YYYY-MM-DD)】、④禁止添加解释性语句 - 对模糊表述做兜底指令:在提示词末尾加一句
“若原文未明确责任人或日期,对应字段填【待确认】,不得留空或自行推测” - 超长文本(>800 字)务必拆段提交,DeepSeek-R1 虽支持 128k 上下文,但长文本易导致后半部分信息衰减,议题遗漏率上升
警惕“自动补全”陷阱:DeepSeek 不会主动追问缺省信息
模型看到“需在下周前完成”不会反问“下周几?谁来做?”,而是默认填【待确认】 或跳过——这恰恰是多数人忽略的关键点。
容易被忽略的地方:所有待办项必须含可执行动词(如“修订”“发送”“确认”),不含“了解”“关注”“跟进”等模糊词;日期必须为完整格式 2026-05-20,不能是“下周三”或“5月20日”——后者会被模型误判为非标准日期而过滤掉。









