讯飞听见ai通过“词库创建→词条录入→识别启用”三步实现专业术语识别优化。用户无需模型微调,只需在网页或app中新建词库、准确填写原文与拼音、在转写设置中启用即可提升识别准确率。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

讯飞听见 AI 实现对特定专业词库的自定义,核心在于“词库创建→词条录入→识别启用”三步闭环。它不依赖模型微调或API开发,普通用户通过网页或APP端操作即可完成,关键是把行业术语的“发音”和“标准写法”明确告诉系统。
新建一个带场景标识的专属词库
登录讯飞听见后,进入项目设置 → 找到“词库管理” → 点击“创建词库”。名称建议直指用途,比如“医疗影像报告词库”“半导体封装工艺词库”。类型选“用户自定义词库”,无需额外开通权限,专业版支持最多10万词条,日常使用几百条已明显见效。
准确录入词条:原文+拼音缺一不可
每条术语必须同时填写“词条原文”和“对应拼音”,系统靠拼音匹配语音流中的发音片段。例如:
- 原文填“PET-CT”,拼音填“p e t c t”(注意字母间空格)
- 原文填“经皮肾镜取石术”,拼音填“jing pi shen jing qu shi shu”
- 避免只填拼音不填原文,或用缩写代替全称(如只输“NLP”而不写“自然语言处理”)
批量导入更高效,格式要严格
大批量术语推荐用.txt文件导入:每行一条,原文与拼音之间用制表符(Tab)或单个空格分隔,不要用逗号或顿号。示例文本内容:
深度学习 shen du xue xiTransformer zhuang huan qi
多模态 duo mo tai
上传后系统自动解析,失败条目会单独提示,可针对性修正后重试。
在转写任务中主动启用该词库
开始实时录音或上传音频前,进入“转写设置” → 在“词库”选项中下拉选择你刚建好的词库 → 确保开关为开启状态。此时系统会在识别过程中优先匹配该词库内的发音-文字映射,显著降低“神经网络”被写成“神精网络”、“OCR”变成“奥赛尔”这类错误。











