kimi提取图片文字有三种正确路径:一、网页端拖图进空输入框自动识别并点击【复制】图标;二、网页端登录后用ctrl+shift+x快捷键或相机图标截图识图;三、手机app上传图片后点击“识别文字”按钮,不可直接发送。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你需要从一张截图、证件照或扫描件里快速抓取文字内容,但Kimi上传图片后没自动弹出文字,说明OCR识别环节没被正确触发——这通常不是模型问题,而是操作路径没走对。
网页端拖图进对话框自动识别
这是最顺手的路径,适合你已经打开Kimi网页聊天页、且图片在电脑本地的情况。
第一步:确保光标正停留在对话输入框内,且输入框为空(如果已有文字,OCR不会启动)。
第二步:直接把图片文件从文件夹拖拽到输入框区域,松手——不要点“上传”按钮,也不要先点图片图标。
第三步:看到页面显示“正在识别…”提示后,等待3~8秒,系统会自动生成一条带【OCR识别结果】前缀的消息。
第四步:点击该消息右侧的【复制】图标(两个重叠方块),文本即刻进入剪贴板。这一步不能右键复制,右键菜单不支持提取纯文本。
网页端用截图工具框选识别
当你面对的是网页上正在显示的表格、PDF预览页或弹窗内容,截图识别比上传更精准,因为能避开压缩失真。
一键设置,在 OpenClaw 和 Claude Code CLI 中使用 Kimi K2.5 (Kimi Code) 作为编程模型。Kimi Code 兼容 Anthropic Messages API——替换……
方法一:快捷键触发(推荐)
按 Ctrl+Shift+X(Windows)或 Cmd+Shift+X(Mac),鼠标变成十字,拖拽框选目标区域后松手,1秒内弹出识别结果框。
方法二:点击相机图标
登录kimi.moonshot.cn后,点右上角相机图标→框选→等弹窗出现→点“复制全部”。
注意:未登录账号时,相机图标灰显不可用,【必须已登录】才能启用该功能。
手机App上传图片调用OCR
适合处理刚拍完的证书、发票或白板笔记,尤其当图片还在相册里没导出到电脑时。
打开Kimi App→进入任意对话→点输入框左侧的“图片”图标→选择“从相册选取”→找到目标图→确认上传。
上传完成后,右下角会出现“识别文字”按钮(不是“发送”按钮),必须点它才会启动OCR;若直接点“发送”,图片仅作为附件发出,不会解析内容。
识别完成的文字会直接填入输入框,此时长按任意位置→选“全选”→点“复制”,即可粘贴使用。










