腾讯ima的图片ocr功能可将会议白板、产品截图等图片中的文字转为可搜索、可引用的知识。上传jpeg/png图片后自动识别,3~10秒出结果;识别文本可复制或生成结构化笔记,需归入知识库方可全局搜索和rag调用。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你想把会议白板照片、产品参数截图或手写笔记扫描件里的文字内容变成可搜索、可引用的知识,直接用腾讯IMA的图片OCR功能就能实现,不用手动打字也不用跳转第三方工具。
上传图片触发OCR识别
打开IMA知识库页面,点击右上角「导入」按钮→选择「本地文件」→从电脑或手机相册中选中一张jpeg或png格式的图片(支持单张或多张批量上传)。
图片上传完成后,系统自动启动OCR引擎,无需点击额外按钮。识别过程通常在3~10秒内完成,取决于图片清晰度和文字密度。
【图片必须为正面拍摄、文字区域无严重反光或遮挡,否则OCR可能漏识别关键字段】
查看与验证OCR结果
上传成功后,点击该图片文件进入预览页,右侧会显示「文字内容」标签页,里面是OCR提取出的全部可复制文本。
腾讯云代码助手CodeBuddy旗下WorkBuddy 4.24.8版本正式发布。本版本重点修复了上下文压缩异常、冷加载时偶现历史消息丢失、任务停止卡死等问题,并深度优化了Windows沙箱(lightSandbox)的日志写入与误弹窗逻辑,提供更安全稳定的AI协作体验。
你可以直接全选→复制→粘贴到笔记或文档中;也可以点击「生成笔记」,让IMA基于识别内容自动生成结构化摘要。
若发现某段文字识别错误(比如“O”被识成“0”,“l”被识成“1”),请返回原图检查是否模糊——IMA不提供手动校对界面,【修改必须重新上传修正后的图片】。
让OCR文字真正可用
第一步:确保图片已归入某个知识库(未归库的图片OCR结果仅临时存在,不参与全局搜索)。
第二步:在IMA首页搜索框输入任意识别出的关键词(例如“QPS峰值”“接口响应时间”),只要该词出现在OCR文本中,这张图片就会出现在搜索结果里。
第三步:在WorkBuddy等接入IMA的工具中,通过@知识库名称调用时,OCR提取的文字会作为上下文片段被RAG机制精准召回,支撑问答或写作任务。










