workbuddy提供四种ocr路径:桌面端图片识别(离线、隐私安全)、自然语言指令触发ai识别(支持路径调用与手写优化)、微信小程序识别(适配低清截图、繁体竖排)、批量处理百张扫描件(需预处理+高精度模式)。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你需要从一张含文字的图片中快速获取可编辑文本,比如会议白板照片、产品说明书截图或手写笔记扫描件,WorkBuddy提供多种路径实现精准提取,无需手动抄录或依赖第三方OCR工具。
桌面端“图片识别”入口直提
这是最直观的方式,适合单张图片、图像质量良好且已打开WorkBuddy桌面客户端的场景。系统调用本地OCR引擎,全程离线运行,隐私有保障。
点击WorkBuddy首页底部导航栏中的“识别”图标。
选择“从相册选取”,导入目标PNG或JPG图像——【务必确保文字区域无反光、无遮挡、画面正对纸面,倾斜超15度会导致识别断行】。
确认图像加载完成后,点击右下角“识别文字”按钮(图标为放大镜叠加字母“A”)。
等待进度条走完,识别结果以可编辑文本形式显示在新页面中,支持长按复制、一键导出为TXT,或直接点击“导出为Word文档”生成.docx文件。
用自然语言指令触发AI自动识别
不用点进功能页,一句话就能让AI帮你找图、选模型、跑OCR、输出结果,适合熟悉快捷操作、追求效率的用户。
方法一:在WorkBuddy主界面顶部搜索框或聊天输入区,输入类似指令:“识别图片D:\资料\报价单.jpg中的全部文字,并保存为Word文档”。
AI会立刻校验路径有效性,弹出确认面板:“已定位图片,尺寸1920×1080,是否立即执行?”
方法二:若图片在当前目录且命名简洁,可简化为:“识别当前文件夹下的发票.png,启用手写体优化模型”——【注意:必须提前在设置中开启“手写体优化”子模型,否则该指令无效】。
点击“确认执行”,系统自动启用高对比度预处理与多模型融合策略,识别结束后自动生成同名.docx文件存于默认输出目录。
使用 draw.io(.drawio 格式)和 SVG 生成兼容 Microsoft Visio 的架构图。当用户需要以下任一场景时触发: - 用于 Visio 或技术文档的架构/系统/网络图 - 带连接标注的分层控制系统图 - 将 draw.io XML 转换为稳定、可嵌入的 SVG - 修复 Visio 或 draw.io 无法打开的故障排查类图表 - 任何需专业级布局且文本可编辑的图表
微信小程序识别低清截图
当你只有微信里转发来的模糊截图、手机截屏或带水印的聊天记录图时,这个轻量方案最省事,不占电脑资源,还能处理竖排和繁体字。
第一步:在微信中搜索并进入“WorkBuddy文档识别”小程序。
第二步:点击“拍照/选图”,允许访问相册权限后,选取目标图片(单次最多5张)。
第三步:上传后系统自动调用云端高精度OCR服务,识别完成即显示文本,支持复制、分享、另存为图片或PDF。
这一步操作起来很简单,直接把文件拖进去就行。但要注意:小程序不支持批量超过5张,也不支持导出Word,如需.docx格式,必须回到桌面端二次处理。
批量处理百张级扫描件
当你要处理几十页合同、上百张发票扫描图时,必须走标准化流程,否则识别率会断崖式下跌。
① 打开WorkBuddy → 右上角设置 → 识别设置 → OCR语言选项,选择“简体中文+英文(混合)”,并勾选“启用高精度模式(占用更多内存)”。
② 用IrfanView或系统画图批量调整图片:统一缩放至≤1920×1080像素,保存为PNG格式——【严禁使用JPEG导入,压缩伪影会导致字符粘连或漏字】。
③ 进入“文件 → 批量导入 → 从文件夹添加”,选择已预处理的PNG文件夹,勾选“按文件名顺序排序”。
④ 点击“开始识别”,紧盯底部状态栏:若连续两页置信度低于65%,立即暂停任务,返回检查对应图片是否存在折痕、阴影或局部模糊。









