讯飞听见pc客户端支持真正批量转写,通过文件夹导入、统一参数预设和自动归档实现高效稳定处理;网页端虽可多文件拖入但限制多、易出错;ai agent能一键整合多份转写稿并结构化输出。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你需要把十几场会议、几十段客户访谈或上百条培训录音一次性变成文字稿,而不是一场一场手动上传、反复设置参数、守着进度条等结果。
用PC客户端实现真正批量转写
这是最稳定、最可控的批量处理路径,尤其适合本地音视频文件已归档、需集中处理的场景。网页端虽支持多文件拖入,但不支持统一参数预设和自动归档,容易漏设热词或语言,导致批量结果质量参差不齐。
第一步:打开讯飞听见PC客户端,登录企业版或高配个人账号(【个人免费版单次最多上传10个文件,且无法开启机器快转加速】)。
第二步:点击【导入文件】→选择“文件夹导入”模式,而非单个文件选择;指定一个干净目录,例如D:\interviews\raw,确保该目录下只放待转写的MP3/WAV/MP4文件,无子文件夹、无文档或临时文件。
第三步:在弹出的参数面板中一次性完成全部设置——语言选“中文(普通话)”,说话人勾选“自动区分”,专业领域按实际内容选“金融”或“医疗”等,热词框内粘贴统一术语表,如“信创、等保2.0、穿透式监管”,注意用英文逗号分隔,且【每个热词不得超过16字符,否则会被截断】。
第四步:点击【提交全部】,客户端自动扫描目录内所有兼容格式文件(mp3/wav/m4a/mp4),生成任务队列;状态栏实时显示“排队中→转写中→已完成”,每条音频右下角有独立进度环,互不影响。
网页端快速批量上传(适合临时应急)
不用安装软件,打开浏览器就能操作,但必须严格遵循格式与数量限制,否则上传会失败或中途中断。
打开https://www.iflyrec.com/,登录后进入【导入音视频】工作台。
统一LLM网关 - 一个API对接70+AI模型,使用单一API密钥即可调用GPT、Claude、Gemini、Qwen、Deepseek、Grok等主流模型。
将所有待转音频文件(命名建议含日期前缀,如20260625_sales_meeting.mp3)直接拖入左侧上传区——【单次最多拖入100个文件,总大小不能超过2GB】。
右侧设置区立即激活,此时必须逐项确认:语言为“中文(普通话)”、说话人设为“自动区分”、专业领域选对应项;热词优化栏里填好核心词,比如“Qwen、通义千问、大模型备案”,别忘了用英文逗号分隔。
点击【+上传音视频】→弹窗确认→页面跳转至任务列表,状态变为“排队中”。若某文件显示“上传失败”,大概率是格式不支持(如DRM加密M4A)或单个超2GB,需单独处理。
用AI Agent一键整合多份转写稿
当所有音频都已完成转写,下一步不是导出Word再手动拼接,而是让AI自动对齐逻辑、提取主线、标注出处。
方法一:在PC端【文件】列表中,按住Ctrl键逐个勾选已完成转写的5~20份文件(支持跨日期、跨项目混选)。
方法二:点击左侧【AI+】图标→选择【AI Agent】→在对话框输入结构化指令,例如:“整合这8份客户访谈稿,按‘客户痛点—现有方案不足—我方产品匹配点’三栏输出Excel表格,每行引用原文片段并标注来源文件名”。
方法三:等待约40秒,系统生成带超链接的结构化结果;点击任意单元格右侧的小喇叭图标,即可跳转回原始录音对应时间点,验证表述是否准确。










