让智能体完成一项任务并不复杂,真正的挑战在于让它“越做越精”。长期以来,办公类智能体普遍采用“交付即固化”的模式:一旦任务执行失败或效果未达预期,就必须依赖人工分析日志、反复调试提示词、增补工具链,再重新验证——整个调优流程耗时长、门槛高,且难以沉淀可复用的经验。
近期,由华为2012实验室联合华为云、终端与计算等多个团队共同打造的开源AIAgent平台openJiuwen,正式发布业界首创的双维度RSI框架(Recursive Self-Improvement,递归式自我演进),并在WorkSwarm蜂群办公智能体中全面落地。该框架首次实现“可插拔Harness + Artifacts”双轨协同优化能力,用户仅需像发起常规任务一样启动一次“实验”,即可全程追踪智能体从试错到收敛、从迭代到升级的完整进化路径。

这一突破为AIAgent自身的持续演进提供了系统化、工程化的实施范式,在真实办公环境中真正实现了“在失败中反思、于任务中成长”。目前,RSI实验机制已正式上线WorkSwarm平台。
办公智能体拥有了专属“成长档案”
早在今年6月,openJiuwen就推出了业内首个AutoHarness能力,使Harness具备实战中自动学习、动态调优的能力,构建起一套评测驱动、覆盖全栈组件的端到端自动化优化体系。而RSI框架则在此基础上更进一步——它能基于真实任务反馈自动生成改进策略、执行验证闭环,并筛选保留有效变更,从而推动智能体实现可持续的能力跃迁。这意味着,面对横跨文档处理、代码生成、数据分析与多工具调用的复杂办公任务,其工作逻辑可被持续打磨,交付成果可被反复精炼,每一次成功或失败都将成为后续任务的知识资产。
据官方介绍,openJiuwen RSI的核心是一套支撑多样化自我演进任务稳定运行的工程底座,以版本化的优化对象、可验证的执行证据和可扩展的算法接口为三大支柱,通过四层协作架构,将抽象的任务目标转化为结构清晰、可执行、可评估的迭代流程。

形象地说,RSI就像一支高度协同的攻坚小组:任务层负责定义“优化什么、如何衡量、资源上限是多少”;迭代优化层决定“下一轮尝试哪些方案、哪些改动值得采纳”;执行层专注“实际运行优化版本并采集反馈”;而基础框架层则统一提供运行时环境、模型上下文管理、沙箱隔离、状态快照恢复及全链路可观测性等底层支撑。
当前,RSI框架已深度集成至WorkSwarm新推出的“实验”模式中。用户只需像创建普通任务一样发起Harness优化或产物优化实验,即可实时查看每轮迭代的过程轨迹、搜索路径与性能变化,最终获取经过多轮验证的最优解。
三大典型场景验证成效显著
经开发者实测验证,搭载RSI能力的WorkSwarm“实验”模式,在需高频试错、渐进优化的办公场景中展现出极强适配性。
以Harness优化为例,当遇到失败用例时,用户仅需四步即可完成高效纠错:
一、准备结构化JSON评测集,包含测试用例、任务说明、评测方法、参考答案与评分细则;
二、进入WorkSwarm“实验”页,选择“Harness优化”,配置优化模型、测试模型、初始插件,并指定评测集、评测方式及最大迭代次数;
三、启动自动优化流程,界面实时呈现得分曲线、迭代轮次、模型调用量及搜索树演化图,所有试错路径与采纳依据一目了然;
四、实验产出优质Harness后,点击“安装插件”,即可将其作为独立插件包热加载至当前工作流。

在权威基准SWE-benchLite上,该模式将Harness优化通过率从61.0%大幅提升至87.0%;进一步冻结优化后的Harness,在Evo-BenchGeneral 64道独立评测题上的单次执行通过率也由60.9%跃升至71.9%,表现极为突出。
在科研论文产物优化方面,WorkSwarm既支持从研究构想出发自动生成初稿,也支持对已有论文进行定向增强。用户只需选定目标论文,输入优化指令(如聚焦的研究主题、待解决的关键问题或重点提升方向),设定最大迭代轮次,即可开启实验。过程中可在详情页实时查看当前得分、最优版本、模型消耗与迭代进度,并完整记录每一轮修改细节、评测反馈及未采纳原因。实验结束后支持在线预览,确认无误后一键下载最终成稿。

算法程序产物优化流程同样简洁高效,支持基于现有代码自动探索多个优化版本。用户准备好初始算法程序、评测配置与任务包后,在“产物优化”中选择“程序”类型,即可一键创建并启动优化任务。详情页将同步展示当前最优得分、模型调用量及程序优化树,每个节点均可展开查看具体改动、评测结果与失败归因。实验完成后,支持一键下载经多轮筛选验证的最优程序,便于后续验证、集成或二次开发。

以“算力亲和”设计降低多轮优化负担
多轮优化的本质是反复生成候选方案、执行任务逻辑、收集评测反馈,背后涉及提示词、工具描述、上下文材料的高频复用,意味着优化规模越大,等待时间与资源开销越不可忽视。高昂成本是否会成为RSI落地的现实阻碍?
openJiuwen的答案是——“算力亲和”:依托国产昇腾AI算力基础设施,让计算引擎深度理解智能体运行状态,通过上下文缓存调度、中间态复用等关键技术,显著压缩多轮优化的响应延迟与资源占用,使智能体在持续进化过程中更高效地利用算力。
实测数据显示,启用“算力亲和”后,智能体平均响应速度提升近16%,最慢场景提速超19%,缓存命中率由7.53%提升至14.36%,关键存储资源消耗下降20%–30%。持续学习与降本增效,在同一框架内得以兼顾达成。

至此,openJiuwen RSI已构建起一条从实验创建、过程追踪到结果交付的完整优化闭环:Harness优化持续升级智能体的“工作方法”,Artifacts优化不断打磨科研论文、算法程序等核心“交付成果”,再叠加“算力亲和”机制减少冗余计算、压降资源开销。这一技术路径,为智能体迈向更高阶的自主演进与复杂任务适应能力奠定了坚实基础。
openJiuwen团队透露,后续将持续拓展RSI框架中的搜索策略、评测维度与融合算法能力,强化跨任务经验迁移效率,并沿统一架构逐步接入模型级优化与混合式优化能力,推动Harness、Artifacts与Models在明确评价标准、预算约束与安全边界的协同下联合演进。值得一提的是,华为云AgentArts平台已将openJiuwen能力深度整合进商业化服务中,提供开箱即用的一站式体验。更多细节,敬请关注华为全联接大会2026现场演示。openJiuwen官网亦同步开放在线体验入口,Token免费发放。










