7月6日,腾讯混元hy3 正式上线。相较于此前发布的preview版本,该模型不仅在同等参数规模下展现出更强的综合智能水平,更在多项关键指标上达到甚至媲美参数量为自身2—5倍的行业旗舰模型;同时,服务定价进一步优化,整体稳定性与性价比实现跨越式提升。目前,hy3 已深度集成至 workbuddy/codebuddy、元宝、marvis、ima 等多个核心业务场景,api 接口已在腾讯云 tokenhub 平台正式开放,此外还将陆续登陆多个海外主流 api 服务平台。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

模型智能全面进阶,智能体实用价值迎来质变突破
Hy3 是一款融合“快思考”与“慢思考”机制的先进大模型,采用 MoE(Mixture of Experts)稀疏架构,总参数量达 295B,激活参数量为 21B,原生支持最长 256K 的上下文窗口。今年4月23日发布的 Hy3 preview,是混元完成底层架构重建后的首个正式迭代版本,在复杂推理、指令精准理解、上下文学习能力、代码生成质量及智能体任务执行等方面,相较前代 Hy2 实现了根本性跃迁;而本次正式版 Hy3 则在此基础上,通过大幅提升后训练阶段的算力投入,并强化数据质量与多样性,推动模型在各类评测任务中再度实现显著升级——以更小的模型体积,首次达成与国内外超大规模旗舰模型相匹敌的实际效果。

混元模型能力快速提升
Hy3 在软件开发、办公提效、金融建模、前端工程、游戏内容创作等高价值生产力场景中进步尤为突出,已成为兼具性能与成本优势的可靠选择。在腾讯内部组织的覆盖270位跨领域专家的真实工作盲测中,Hy3 平均得分达 2.67 / 4,优于 GLM5.1(2.51 / 4),尤其在前端开发、数据与存储管理、CI/CD 流水线构建等细分方向表现领先。
历经海量用户真实场景锤炼,用户体验实现显著跃升
Hy3 在全球开发者社区及腾讯庞大自有业务体系中持续接受高强度实战检验。自 preview 版本上线以来,其日均 token 消耗量激增20倍,印证了其作为高性价比实用型模型的市场认可度正快速提升。
作为国内用户规模领先的AI办公智能体,WorkBuddy 承载着自动化脚本编写、多步骤工作流编排等复杂且高频的真实需求,为混元模型的能力演进提供了极具指导意义的方向标。自 preview 发布起,主动选用 Hy3 preview 的 WorkBuddy 用户数量增长达6倍。在 WorkBuddy 办公专项内测中,Hy3 将任务成功率由 72% 提升至 90%,平均单次任务耗时缩短34%,问题解决过程更省心、响应更高效。
元宝所承载的自然语言对话与AI搜索交互场景,也为模型优化提供了关键反馈。针对长文本处理与AI检索中易出现的幻觉问题,Hy3 引入细粒度数据清洗策略与强约束训练机制,使模型在多源证据支撑下仍能稳定输出可信结果。基于真实用户日志的对比评测显示:Hy3 的常识性错误率较 preview 下降50%,幻觉发生率降幅超50%。依托大幅提升的 Agent 能力,元宝同步上线全新 Agent 功能。在其内部综合评估中,Hy3 在办公协同与生活服务两大高频场景中已全面超越 GLM 5.1 等一批国产优秀模型,具备稳定支撑全链路真实业务的能力。用户只需输入日常需求,元宝即可自主完成复杂任务并直接交付 PPT、Word、Excel、PDF、HTML 等多种格式成果,全程免费可用。
ima 围绕线上知识库问答与智能体(Agent)两大核心应用场景对 Hy3 进行了深度验证。在 Agent 类任务中,Hy3 综合表现优异,系统整体稳定性高达 95.1%,其中工具调用与流程编排能力尤为突出,“盲目重试”“应停未停”等低效操作大幅减少,使得复杂办公任务的规划准确性与一步到位率明显增强。知识库问答能力亦同步强化,推理质量净提升近19%,思考逻辑更系统、信息覆盖更全面,长文撰写与方案生成的结构完整性与实际可用性显著改善。
在 Marvis Agent 的文件编辑与生成、智能文件管理、电脑故障诊断与远程操作等关键场景评测中,Hy3 的任务完成率达 93.7%,较 preview 提升 12.7%;在六类 Agent 协同调度任务中,任务分派准确率达 92%,较 preview 提升13.5%。此外,Hy3 在复杂任务执行、多步 Agent 工作流编排、办公自动化落地、幻觉抑制等多个维度均展现出实质性能力跃迁,已可稳定支撑真实业务闭环,切实提升了 Marvis Agent 的执行可靠性、响应实时性与整体运营成本效益。
混元持续赋能微信生态与游戏业务。在微信公众号 AI 分身与客服专项测试中,Hy3 的意图识别准确率提升至 98.94%,即便面对语义不完整或模糊表达,也能结合账号属性与上下文进行合理推断,避免过度脑补或机械套用模板。在微信读书场景中,Hy3 相比 preview 版本的标签标注准确率提升 14.1%,整体分类效能提升 8.4%。在游戏领域,WeGame 近期上线的《流放之路:降临》AI 游戏助手接入 Hy3 后,多轮推理与工具调度综合成功率提升至 92%,幻觉率由 4.5% 降至 2.8%,输出准确性与玩家体验双双优化。
腾讯丰富多元的产品矩阵,为混元模型的持续进化提供了广泛、高频、真实的反馈闭环;而混元能力的每一次跃升,又反向驱动各业务线体验升级,形成可迁移、可泛化的正向循环。例如,对话场景中对意图理解与风格适配的优化,同样可迁移至各类 Agent 场景;而智能体工具调用能力的增强,也显著助力对话式搜索等业务的准确性与实用性提升。
坚持普惠开放路线,让高价值AI能力触达更多用户与行业
Hy3 延续“实用、普惠”的产品定位,以极具竞争力的价格对外提供服务:输入价格为 1元/百万tokens,输出价格为 4元/百万tokens,缓存命中输入仅需 0.25元/百万tokens。
在开源方面,Hy3 采用国际通行、商业友好度极高的 Apache 2.0 协议,全球开发者均可自由下载并用于商用项目。为更好服务海外开发者群体,Hy3 将陆续登陆 OpenRouter、Hermes、Kilo、Cline、OpenClaw、OpenCode、CherryStudio 等多个国际主流模型平台;同时,也将于“发布首日(Day 0)”同步上线 Hugging Face 与 ModelScope(魔搭)两大开源模型社区。
从2026年1月底启动基础设施全面重构,到4月 Hy3 preview 首次亮相,再到今日正式版 Hy3 的全面升级,混元仅用不到半年时间,便完成了从底层技术重塑到上层产品反哺的完整研发闭环。未来,腾讯混元将持续加速技术演进节奏,不断逼近大模型智能能力的理论上限,并聚焦真实产业场景的深度落地,致力于将前沿的大模型技术转化为千行百业可感、可用、可复制的普惠生产力。











