讯飞听见通过声纹识别与ai聚类分析自动区分发言人,支持3人以上会议稳定标注“张三”“李四”;需手动开启“区分说话人”或选择“多人会议”模式;提升准确率需避免交叉发言、固定收音位置、提前录入声纹、控制环境噪音;转写后可修改发言人标签、绑定声纹、筛选查看、生成个人摘要;特别适用于跨部门协调、客户洽谈、内部评审及方言外语混合场景。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

讯飞听见能自动识别不同发言人,核心靠的是声纹识别+AI聚类分析,不是简单按音量或停顿切分。只要现场收音清晰、人声不重叠,3人以上会议也能稳定区分角色,转写时直接标出“张三”“李四”,不用手动对号入座。
开启区分说话人功能的操作路径
这个功能默认不强制开启,需要主动设置:
- 网页端或PC客户端进入【实时录音】页面,点击【开始录音】前,先点设置按钮,在弹出面板里勾选“区分说话人”
- 也可以直接选择“多人会议”模式(比“双人会谈”更适配3人及以上场景),该模式下“区分说话人”默认启用
- 手机App端在录音界面右上角找到齿轮图标,进入设置页,打开“自动识别发言人”开关即可
提升识别准确率的关键细节
自动分人效果好不好,一半看设备,一半看现场条件:
- 避免多人同时讲话——交叉发言越多,声纹边界越模糊,建议养成“一人说完再换人”的会议习惯
- 每人尽量用独立麦克风或保持固定位置——距离和角度变化过大会影响声纹建模稳定性
- 提前录入声纹更可靠:在客户端“说话人管理”里让常参会者朗读10秒引导语,系统存下专属声纹模板,后续识别准确率明显提升
- 环境噪音要低——空调、投影仪、键盘敲击等持续底噪会被讯飞自研降噪算法过滤,但突然的关门声、手机铃声仍可能干扰判断
会后快速确认与修正
识别结果不是一锤定音,支持灵活调整:
- 转写完成后,点击任意一段文字左侧的“发言人1”“发言人2”标签,可直接修改为真实姓名或角色名(如“财务部王经理”)
- 选中某段内容,点“保存说话人”,系统会把这段语音特征绑定到你输入的名字下,下次再出现类似声纹就自动匹配
- 用【说话人筛选】功能,只看某个人的全部发言,方便核对职责分工或待办事项
- 开启“高精转写”后,还能一键生成每位发言人的内容摘要,比如领导的决策要点、技术同事的风险提示等
哪些场景特别适合用这个功能
不是所有会议都必须开区分说话人,但以下几类最值得打开:
- 跨部门协调会——市场、研发、运营轮流汇报,观点交织,分角色看纪要才能厘清责任线
- 客户洽谈/招标答疑——甲方乙方交替发言,关键承诺和质疑必须归属明确,避免后续扯皮
- 内部评审会(如产品原型评审)——设计师、测试、PM各说各话,结构化呈现便于追溯修改依据
- 含方言或外语的会议——讯飞支持12种方言+10种外语混合识别,配合分人标注,连“粤语提问+普通话回答”也能理清楚











