法国人工智能初创公司mistral ai于本月23日正式发布全新文档内容识别模型ocr 4,在光学字符识别(ocr)领域引发广泛关注。这款轻量级但功能完备的模型支持涵盖10大语系的共计170种语言,并在权威评测基准omnidocbench中取得93.07分的优异成绩,其文本识别质量在人类评估中优于gpt 5.5 pro、gemini 3.1 pro preview等主流竞品。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

轻巧高效,适配多元下游应用
OCR4 并未以参数量为竞争焦点,而是专注于文档理解任务的精准与实用。它不仅能准确提取文本内容,还可同步输出文字区域边界框、文档结构类别标签及识别置信度分数,全面赋能RAG语义切片、智能体基础单元结构化、连接器内容解析等多种实际应用场景。
Gemini Notebook网页版是一款基于AI的智能笔记工具,其核心功能是让用户上传个人文档(如PDF、文本等),并以此为基础进行交互。它能针对你的资料进行总结、解答疑问、生成新内容,让信息处理更高效。该版本为在线使用,无需下载安装。
在商业化层面,OCR4 提供两种计费模式:基础API调用价格为每千页4美元,若选择批量处理则可享五折优惠;面向文档AI场景的增强版服务定价为每千页5美元。
作为欧洲最具影响力的AI初创企业之一,Mistral AI此前凭借开源与闭源双轨并进的模型布局迅速赢得全球开发者青睐。此次OCR 4的推出,标志着其技术能力正式从通用大语言模型拓展至文档智能这一关键垂直领域,开始在底层工具层与OpenAI、Google等科技巨头展开直接对标。










