腾讯ima支持上传文件自动生成双人对话式有声播客,需先申请内测开通任务模式,再通过知识库或聊天框上传文档,配置音色、语速、开场白等参数后一键生成并下载mp3。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

想把一篇长报告、一本书或会议纪要变成能边走边听的真人语调播客,不用找配音员、不用写脚本、不用剪辑——腾讯IMA现在支持上传文件直接生成双人自然对话式有声播客,语音带情绪、有停顿、有角色分工,全程自动完成。
确认前提:先开通任务模式
IMA播客生成功能依赖“任务模式”,该模式目前仍处于内测阶段。打开IMA主界面,点击右上角「申请内测」按钮,填写简单信息后等待系统审核(通常10分钟内通过)。【未开通任务模式将无法看到“生成播客”入口】
审核通过后,首页顶部导航栏会出现「任务模式」标签,点击进入即可开始操作。
上传文件→触发播客生成
方法一:从知识库发起(推荐)
进入「知识库」→点击左上角「导入」→拖拽PDF/Word/PPT/Excel等本地文件→上传成功后,右侧操作栏自动出现「生成播客」按钮,点击即启动。
方法二:从聊天框发起
在任意对话窗口中,直接将文档拖入聊天输入区→等文件图标显示为“已就绪”→下方弹出快捷操作菜单→选择「生成播客」。
注意:网页链接暂不支持直接生成播客,必须先保存为本地文件或通过微信小程序存入知识库后再操作。
配置播客参数并生成
第一步:选择对话形式
系统默认启用「双人对话」模式,角色会自动分配为“主讲人+互动者”,模拟真实播客的问答节奏;如需单人讲述,可在设置页关闭“双人模式”开关。
版本定位为桌面办公端,适合 Windows 用户处理本地文件、资料阅读、问答写作和知识库管理。主要特性围绕桌面端文件处理、知识库调用和 AI 工作台操作展开。建议从官网或官网公开下载包获取,不建议使用第三方搬运包。适合生产环境使用。注意事项是当前仅查到 x64 安装包,暂未查到官方公开 ARM Windows 安装包。
第二步:指定音色与风格
点击「音色偏好」→从6种预设音色中选择(如“知性女声-北京口音”“沉稳男声-上海腔调”)→滑动调节语速(0.8x~1.3x)→开启“重点强调”可让AI自动重读关键数据和结论。
第三步:补充开场与配乐(可选)
在「高级设置」中输入开场白,例如:“欢迎收听《认知科学入门》精讲播客,我是小陈,今天和你一起拆解这本书的核心逻辑。”→勾选「添加环境音效」可加入咖啡馆背景音或轻音乐前奏,时长控制在8秒以内。
第四步:点击「开始生成」→系统进入两阶段处理:先用50秒左右生成结构化脚本,再用90秒左右合成音频。整个过程无需人工干预,进度条实时显示。
导出与使用生成的播客
生成完成后,页面自动跳转至成果页,左侧显示文字稿(含时间戳),右侧嵌入播放器,点击即可试听。
点击播放器下方「下载MP3」按钮,文件默认命名为“文档标题_生成日期.mp3”,保存到本地后可导入手机播客App或车载系统。
点击「分享」可生成专属链接,他人点开即听,无需登录IMA账号;链接有效期为30天,过期后需重新生成。










