mimo code 支持三层定制:运行模式(build/plan/compose)、模型替换(云端/本地/多厂商)、记忆策略(四层记忆体系)及 spec-manager 工程规范注入。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

MiMo Code 的行为不是固定死的,它支持多层定制——从运行模式切换、模型替换,到记忆策略调整、任务流程约束,甚至能通过 spec-manager 加入工程级规范。关键在于理解它的三层控制逻辑:模式决定“能做什么”,模型决定“怎么思考”,配置决定“怎么协作”。
按需切换三种核心运行模式
MiMo Code 默认启用 build 模式,但真正发挥定制价值的是 plan 和 compose 模式:
- build 模式:全权限执行,可读写代码、运行命令、提交 Git。适合已确认需求后的快速实现。
-
plan 模式:只读分析,禁用所有写操作。适合接手陌生项目时做架构扫描、技术债评估或安全审查——输入
!plan即可临时进入,无需重启会话。 -
compose 模式:面向规格驱动开发,强制走 L1PRD→L2Design→L3Impl 流程。开启后,任何功能请求都会被拦截并引导你先创建规格,再冻结执行。启动方式:
mimo compose或在会话中输入!compose。
三种模式可通过 Tab 键实时切换,状态显示在终端左下角,切换后上下文自动保留,不丢失当前任务进度。
替换或微调底层模型
MiMo Code 不绑定单一模型,你可以根据场景灵活选择:
统一LLM网关 - 一个API对接70+AI模型,使用单一API密钥即可调用GPT、Claude、Gemini、Qwen、Deepseek、Grok等主流模型。
- 默认使用限时免费的 MiMo-V2.5(百万 Token 上下文),适合大多数开发任务;
- 想用已有账号接入第三方模型?支持 DeepSeek、Kimi、GLM 等 75+ 厂商,只需在
~/.mimo/config.json中填写 API key 和 endpoint; - 本地部署模型更可控?配置
local_model_path指向 GGUF 文件,搭配 llama.cpp 即可离线运行; - 对响应质量敏感?可在 config 中启用 Max Mode(默认关闭),让每步决策生成 5 个候选方案并由验证器择优,提升长任务稳定性,代价是 token 消耗增加约 4–5 倍。
调整记忆与上下文管理策略
MiMo Code 的四层记忆体系(会话级 notes.md、项目级 checkpoint、Writer 子Agent 记录、磁盘持久化结构字段)允许你干预其“记住什么”和“如何回忆”:
- 想减少自动 checkpoint 频率?修改
checkpoint_threshold(默认 20%/45%/70%),比如设为 30%/60% 可降低 I/O 开销; - 希望 Writer 子Agent 提取更多设计决策?编辑
memory_schema.json,在design_decisions字段添加自定义关键词(如 “兼容性考虑”、“降级方案”); - 跨会话复用项目理解?确保
project_memory_enabled: true,并在首次会话结束前运行!distill主动提炼项目摘要; - 敏感项目禁止磁盘记录?设置
disk_persistence: false,此时仅保留内存中 notes.md 和临时 checkpoint。
用 spec-manager 注入工程流程约束
单纯让 MiMo Code 更聪明,不如让它更守规矩。spec-manager 是官方推荐的增强层,不改模型,只加流程:
- 安装后,所有
mimo spec命令都可用,例如spec new L1 –topic payment创建需求说明书; - L3 规格冻结前,
build或compose模式下的代码修改指令会被拒绝,并提示“请先完成 L3Impl 规格”; - 每次执行后自动生成验证证据(diff + test output + commit hash),存入
specs/auth-L3.1/proof/目录; - 多人协作时,
spec sync可拉取远程仓库中的规格文件,确保团队对同一任务的理解一致。
它把 AI 从“随叫随到的程序员”变成“按流程交付的协作者”,特别适合需要审计、复盘或交接的团队场景。










