使用 Tesseract.js OCR 从图像中提取文本(100%本地运行,无需API密钥)。支持中文(简繁体)和英文。
OCR - 图像文本识别( 本地)是一项面向实际任务的技能,主要用于使用 Testeract. js 的图像中提取文本, 100% 本地运行, 不需要 API 密钥;支持中英文;
从功能定位来看,该技能强调把分散的操作要求整理成清晰、可复用的处理流程,使用户能够围绕既定目标快速准备输入、选择执行方式并获得结构化结果。实际使用前应先确认任务范围、数据来源、运行环境、必要权限和关键参数,再依据技能说明逐步执行;若输入条件不完整,应先补齐信息或采用保守配置,避免因错误假设导致结果偏离需求。
执行过程中需要关注工具调用是否成功、接口或依赖是否可用、输出格式是否符合预期,并对异常提示、缺失字段和边界情况进行处理;涉及批量任务时,还应保存进度,避免中断后重复操作。该技能适合用于一次性任务,也可以接入自动化工作流,与其他技能或上层代理配合完成更完整的业务链路;在组合使用时,应明确每一步的输入输出关系,并避免不同步骤之间出现参数冲突。
使用 Tesseract.js 从图像中提取文字。100% 本地运行,无需 API 密钥。 支持中文与英文。
node {baseDir}/scripts/ocr.js /path/to/image.jpg
node {baseDir}/scripts/ocr.js /path/to/image.png --lang chi_sim
node {baseDir}/scripts/ocr.js /path/to/image.jpg --lang chi_tra+eng
--lang :语言代码(默认值:chi_sim+eng)
chi_sim — 简体中文chi_tra — 繁体中文eng — 英文+ 组合多种语言:例如 chi_sim+eng--json:以 JSON 格式输出,而非纯文本
# 识别中文截图
node {baseDir}/scripts/ocr.js screenshot.png
# 识别英文文档
node {baseDir}/scripts/ocr.js document.jpg --lang eng
# 识别中英文混合图像
node {baseDir}/scripts/ocr.js mixed.png --lang chi_sim+eng
相关专题
热门下载
相关下载
精品课程
共6课时 | 54.6万人学习
共89课时 | 133.1万人学习
共49课时 | 82.1万人学习