leanstral是什么
leanstral 是由 mistral ai 推出的首款开源 ai 代码智能体,专为 lean 4 定理证明器量身打造。该模型采用稀疏专家混合(moe)架构,总参数达 120b,每次推理仅激活约 6b 参数,可高效生成形式化数学证明并验证代码逻辑正确性。相较于同类大型闭源模型,leanstral 在显著降低运行成本(单次调用仅需 $18)的同时,在真实数学项目(如费马大定理形式化工程)中展现出更强的推理能力与实用性。模型原生支持 mcp 协议扩展,并已深度集成至 mistral vibe 平台。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

Leanstral的主要功能
- 自动化形式化证明生成:面向 Lean 4 证明环境,直接产出符合数学严谨性的形式化证明脚本及软件规范验证代码。
- 形式化代码正确性验证:依托 Lean 4 内置的完备类型检查与逻辑验证机制,确保生成结果满足严格的形式语义约束,大幅减少人工审核负担。
-
精准故障诊断与修复建议:能识别常见 Lean 编码错误(例如
def与abbrev在类型别名定义中的误用),定位根本原因并提供可执行的修正方案。 - 多证明语言自动迁移:支持将 Rocq / Coq 等主流交互式证明语言编写的代码,高保真转换为 Lean 4 语法,完整保留用户自定义符号、记号系统与逻辑结构。
- 前沿数学定理辅助证明:已在多个真实数学代码库(如费马大定理项目)中完成复杂引理推导、新概念建模与端到端形式化验证任务。
Leanstral的关键信息和使用要求
- 研发机构:Mistral AI
- 产品定位:全球首个面向 Lean 4 全栈优化的开源 AI 代码智能体
- 模型架构:稀疏 MoE 架构,120B 总参数 / 6B 激活参数
- 开源协议:Apache 2.0(完全开放权重与推理代码)
- 调用成本:单次请求 $18;pass@2 场景下总成本仅 $36(相较 Claude Sonnet 的 $549 成本降低 93%)
- 评测表现:FLTEval 基准 pass@4 得分为 29.3,领先多数同规模开源竞品
-
Mistral Vibe 集成:开箱即用,输入
/leanstall命令即可启动,无需本地配置 -
Labs API 访问:限时开放免费/低价端点
labs-leanstral-2603,适用于开发者快速集成 - 本地部署支持:提供官方发布的 Apache 2.0 授权模型权重,支持私有服务器或边缘设备离线运行
Leanstral的核心优势
- 超高推理效率:以仅 6B 激活参数实现超越千亿级通用模型的 Lean 专项性能,达成算力、速度与精度的最优配比。
- 颠覆性成本控制:单次任务费用仅为 $18,相当于 Claude Sonnet 单价的 1/15,却在关键验证任务中反超其效果。
- 彻底开源可控:遵循 Apache 2.0 协议全面释放模型权重与工具链,杜绝厂商锁定,保障企业级数据主权与定制自由度。
- 垂直领域深度适配:基于海量 Lean 4 数学代码与证明文档进行专业化训练,在真实数学工程场景中远胜通用大模型。
- 可验证可信输出:所有生成代码均附带机器可检的形式化证明,将传统依赖人工经验的审查流程升级为全自动、可复现的数学验证闭环。
- 生态无缝兼容:原生适配 MCP(Model Control Protocol)标准,可即插即用地嵌入现有 IDE 插件、语言服务器与 CI/CD 流水线。
如何使用Leanstral
-
Mistral Vibe(新手首选):登录 Mistral Vibe 平台,在聊天界面输入
/leanstall指令,即可零门槛启用 Leanstral,无需安装任何依赖或配置环境。 -
Labs API(面向开发者):通过调用公开端点
labs-leanstral-2603快速接入,当前处于限时免费阶段,适合构建自动化验证服务或嵌入自研应用。 - 本地部署(高级用户):从官方渠道下载 Apache 2.0 授权的完整模型权重,在自有 GPU 服务器或工作站上独立部署,实现全链路数据不出域与完全自主管控。
-
最佳实践建议:推荐搭配
lean-lsp-mcp工具链使用,可最大化发挥其在形式化证明生成、实时错误反馈与交互式调试方面的潜力,尤其适用于高保障级别数学建模与安全关键型软件验证场景。
Leanstral的项目地址
Leanstral的同类竞品对比
| 对比维度 | 模型 | 规模 | FLTEval得分 | 成本 | 特点 |
|---|---|---|---|---|---|
| **Leanstral** | Leanstral-120B-A6B | 120B/6B | 26.3 (pass@2) 29.3 (pass@4) 31.9 (pass@16) | $18-$290 | 专为Lean 4优化,开源,MCP扩展 |
| **开源竞品** | Qwen3.5-397B-A17B | 397B/17B | 25.4 (pass@4) | – | 需4轮才能达到Leanstral 2轮效果 |
| Kimi-K2.5-1T-A32B | 1T/32B | 20.1 (pass@4) | – | 规模巨大但得分瓶颈明显 | |
| GLM5-744B-A40B | 744B/40B | 16.6 (pass@4) | – | 参数最大但性能最差 | |
| **闭源竞品** | Claude Opus 4.6 | – | 39.6 | $1,650 | 质量最高但成本是Leanstral 92倍 |
| Claude Sonnet 4.6 | – | 23.7 | $549 | 成本是Leanstral 15倍,得分更低 | |
| Claude Haiku 4.5 | – | 23.0 | $184 | 性价比平庸 |
Leanstral的应用场景
- 大规模形式化数学工程:支撑费马大定理、奇点分类等前沿数学项目的全流程自动化证明,包括引理发现、中间步骤补全与新公理体系构建。
- 高保障软件系统验证:对 Rust、C 等系统级语言的关键模块进行属性级验证(如内存安全性、无死锁、数值不变性),服务于航空航天、金融基础设施等 mission-critical 场景。
-
Lean 生态版本演进适配:自动识别因 Lean 版本升级引发的破坏性变更(如
def/abbrev语义差异、命名空间重构),生成兼容性修复补丁与迁移指南。 - 跨证明语言协同开发:实现 Coq/Rocq 到 Lean 4 的双向代码映射与语义对齐,助力多团队协作与已有数学成果复用。
- 智能交互式调试支持:不仅能定位编译失败的具体位置与类型错误根源,还可自动生成最小复现实例、修复建议及形式化依据说明,显著提升开发者调试效率。











