minimax 2026年大模型进展聚焦自主性、场景深度适配与原生工作流融合:m2.7全量上线并支持自进化闭环;agent 2.0桌面工作台落地,实现本地文件与应用协同;m2.5-lightning轻量变体以10b参数、0.3美元/百万token投入规模化部署;forge rl框架加速强化学习迭代;spec-writing能力已嵌入办公流水线,支持高保真多格式交付。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

如果您关注Minimax在2026年的大模型进展,会发现其技术演进已进入以自主性、场景深度适配和原生工作流融合为特征的新阶段。以下是当前已公开发布、正在实测或明确进入产品管线的关键动态:
一、M2.7自进化大模型全量上线
M2.7搭载自研模型自进化体系,可深度参与自身迭代流程,自主构建复杂智能体框架,并依托多智能体协作、复杂技能调用与工具检索能力,完成自主优化、问题排查与代码修复等全流程闭环工作。该能力已在MiniMax Agent与开放平台全量上线,同步开放API服务与Coding Plan订阅。
1、模型通过AgentHarness结构实现内部任务评测集的自主构建与迭代;
2、在软件工程优化实验中,M2.7自主完成超100轮迭代循环,内部评测集效果提升30%;
3、线上生产环境故障调试中,模型能关联监控指标与部署时间线进行因果推理,将故障恢复时间缩短至三分钟以内。
二、MiniMax Agent 2.0桌面工作台全面落地
MiniMax Agent 2.0定义为AI原生工作台,突破传统对话框形态,实现对本地文件系统、桌面应用与网页自动化任务的统一感知与协同执行。其核心支柱包括桌面端应用、Expert Agents专家分身及用户自定义专家构建能力。
1、Windows与Mac双版本桌面应用已正式上线,支持本地文档读写与跨窗口操作调度;
2、Expert Agents封装私有知识与行业SOP,将通用专家组合能力从70分提升至95分以上;
3、用户可在桌面与网页双端限时免费体验Expert Agents功能,并基于上下文自由配置专属专家行为。
三、M2.5-Lightning轻量级变体投入规模化部署
M2.5-Lightning作为M2.5系列的高效变体,激活参数量控制在10B级别,支持高达100 TPS吞吐量,推理速度约为Claude Opus 4.6的3倍,专为低延迟、高并发的Agent生产环境设计。其输入价格为0.3美元/百万Token,输出价格为2.4美元/百万Token。
1、已在Coding Plan订阅服务中默认启用,面向个人开发者提供无限运行复杂Agent的经济可行性;
统一LLM网关 - 一个API对接70+AI模型,使用单一API密钥即可调用GPT、Claude、Gemini、Qwen、Deepseek、Grok等主流模型。
2、支持私有化部署,适用于企业级安全合规场景;
3、按每秒100 Token输出速率连续运行一小时的成本约为1美元。
四、Forge RL框架驱动的强化学习能力持续释放
Forge RL是Agent-native的强化学习框架,通过引入中间层完全解耦训练-推理引擎与Agent逻辑,支持任意Agent集成,并优化模型在Agent scaffolds与工具链上的泛化能力。该框架已支撑M2.5与M2.7两代模型的快速迭代。
1、采用树状结构化样本合并策略,实现约40倍训练加速;
2、基于CISPO算法保障MoE模型在大规模训练中的稳定性;
3、过程奖励机制(Process Reward)对生成过程中每一步质量进行端到端打分与监控。
五、Spec-writing能力进入真实办公流水线
M2.5与M2.7均具备原生Spec行为:在生成代码前,以架构师视角主动拆解功能模块、系统结构与UI交互路径,完成完整前期规划。该能力已嵌入Word、Excel、PPT等办公文档处理流程,支持高保真多轮编辑并输出可直接编辑的成品文件。
1、在GDPval-AA评测中,M2.7取得1495分ELO评分,位居开源模型首位;
2、可基于用户模糊指令自动补全文档模板、公式逻辑与图表结构;
3、支持多步骤复合办公任务,如“根据Q1销售数据生成含同比分析的PPT汇报稿,并导出PDF与可编辑PPTX双格式”。










