6月初的ai圈,有两件事值得并列观察。
一件是OpenAI举办的“Intelligence at Work”发布会。会上官方披露:Codex周活跃用户已突破500万,相较年初激增8倍;其中非开发者用户占比达20%,涵盖分析师、营销人员、运营、设计师、研究员、投资人及投行从业者等多元角色。更关键的是,这部分知识工作者用户的增速,是开发者群体的3倍以上。与此同时,OpenAI宣布,未来数周内将把Codex的核心能力深度整合进ChatGPT应用,使其从对话入口升级为执行入口。
另一件事是豆包在公众号发布长文,正式回应“豆包专业版”传闻,并明确表示:即将上线覆盖软件开发、数据分析、专业设计、流程自动化、金融分析、科学研究六大方向的专业版本;目前PC端已开放内测,移动端暂未上线。
两条消息几乎同步落地,折射出一个共识——无论是ChatGPT还是豆包,均已判断:Agent技术由实验室走向办公桌、由辅助对话迈向自主执行的临界点已然到来。AI助手的下一程,不再是“聊得更好”,而是“做得更多”。
ChatGPT与豆包虽坐拥庞大用户基数,但商业化始终承压。值得注意的是,近几个月OpenAI已通过Codex实现可观营收增长——2026年第一季度财报显示其总收入约57亿美元,Codex成为核心增长引擎。这一路径,正为豆包的专业化转型提供现实参照。
01
豆包当前最缺的,正是Codex式的生产力底座
尽管豆包在国内AI助手月活中位居首位,但在多数用户心智中,它仍偏向娱乐向工具,尚未建立起“可靠工作搭子”的专业信任。这一点,从“豆包要收费”消息传出后部分用户的调侃式反馈——“又笨又收费”——便可见一斑。
扭转形象,刻不容缓。
被寄予厚望的豆包专业版,不仅承载着商业化使命,更肩负着重塑定位的关键任务。据内部信息,本月底随专业版同步上线的,还有豆包全新迭代的大模型。该模型重点强化工作流理解与多步骤任务调度能力,旨在提升其在真实办公场景中的稳定性与可用性。
36氪近期报道指出,字节跳动今年确立两大战略重心:一是夯实Coding底层能力,推动Dogfooding(内部实测+数据回流+评测闭环),持续打磨Agent基础;二是加速豆包商业化进程,主攻“办公”这一高价值场景。
豆包专业版所划定的六大领域——软件开发、数据分析、专业设计、流程自动化、金融分析、科学研究——恰好与Codex当前全面覆盖的能力矩阵高度重合。
在今年6月的发布会上,Codex一次性推出六大岗位专属智能体插件,涵盖数据分析、销售、创意制作、产品设计、股权投资、投资银行。每个插件均预置对应领域的工具链接入权限、行业知识图谱与标准操作流程,相当于为用户配备了一位“全流程熟手同事”。
相较ChatGPT偏重文本生成与创意表达,今年2月发布的Codex桌面版已实现本地化运行:可直接读取本地文档、调用飞书等第三方办公软件,甚至完成Excel公式编写、Slack消息自动归档、PowerPoint结构化排版等具象操作——在权限深度与行为拟真度上,更接近“人在用电脑”。
Codex融入ChatGPT的战略意图,远不止打造一款“超级App”。其深层动因,在于捕捉用户结构的历史性拐点:Codex早已脱离纯编程工具定位,非开发者用户正以爆发之势涌入。当知识工作者占比升至20%,且增速三倍于开发者时,OpenAI意识到——真正的商业机会,不在代码世界,而在千行百业的工作流里。
这也解释了为何OpenAI选择此时加码Codex商业化,并将其作为财报增长主引擎。而对豆包而言,其用户规模具备天然优势,但挑战在于:Codex已走过一年沉淀期,口碑与生态初具雏形;豆包则需在极短时间内,构建同等专业可信度。
尤其在软件开发领域,要真正胜任企业级需求,必须跨越代码仓库管理、权限控制、安全审计、上下文窗口扩展、单元测试集成、依赖解析、多人协同等多重门槛。目前豆包在代码生成与理解方面的表现,尚难与Kimi、智谱等垂直模型比肩。
不止编程,金融分析与科学研究等场景,对准确性、逻辑严密性、合规性要求极高。日常聊天容错率尚可,一旦涉及投研结论、财报解读或实验推演,用户对错误的容忍度趋近于零。
正如一位用户在豆包专业版说明文末留言所言:“别再只做一个更聪明的聊天框了,请真正打通专业软件的API、嵌入真实工作流——我们才愿意心甘情愿付费。”
02
豆包的Agent底座,会是TRAE还是扣子?
这场专业化的突围战并不轻松。豆包靠免费策略多年积累,DAU稳居国内AI助手榜首,却长期缺乏清晰变现路径。切入办公场景、推出付费专业版,只是其商业化落地的第一步。
若OpenAI能借组织重构与产品融合走出“超级应用”之路,豆包同样拥有复制的可能性。ChatGPT背后站着Codex,而豆包身后,是字节跳动自研的TRAE与扣子(Coze)双引擎。
时间回拨至2026年3月底至4月初:TRAE SOLO完成重大升级,从专注AI编程的工具,跃迁为通用Agent工作台。除保留面向开发者的Code Mode外,全新上线Agent Mode(智能体模式),专为产品经理、数据分析师、运营等非技术角色设计,擅长处理文档摘要、数据清洗、PPT生成等高频办公任务。
为凸显转型决心,TRAE界面醒目打出标语:“不止于码,大有可为”;网页版底部亦标注:“双模式智能体,Work模式与Code模式一键切换”。
这意味着,曾被视为“程序员小助手”的TRAE,正全力拓展边界,志在成为面向更广泛职场人群的通用Agent生产力平台。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

而另一款真正意义上原生定义为Agent平台的产品,则是扣子(Coze)。所谓“扣子编程”,仅是其能力的一个子集。
6月1日,扣子3.0迎来全端升级:网页端支持任务创建与项目管理,桌面端可直连本地文件系统,手机App则支持任务推进、Agent调度,甚至实现远程“遥控”电脑操作——每一项功能,皆具典型Agent特征。
此次升级最大亮点在于开放性:已部署Claude Code、Codex CLI、OpenClaw等本地Agent的用户,如今可将其无缝接入扣子平台。这些原本分散在各自工具箱中的智能体,将首次汇聚于同一项目空间,围绕统一目标协同执行。
“让别人的Agent,也能跑在我的平台上”——这一能力,标志着扣子正瞄准Agent平台层的制高点。
不妨大胆设想:相较于更聚焦代码执行层的TRAE,若扣子作为Agent底座深度接入豆包,或将构成豆包专业版最具可行性的技术路径。扣子所具备的流程自动化、多工具调用、低代码编排、办公助手、插件市场、知识库集成、工作流引擎等能力,恰好可横向支撑豆包专业版全部六大方向。
当用户在豆包中提出“帮我分析这家公司”“生成一份投研报告”或“把表格清洗后做成PPT”时,背后实际是由扣子式Agent完成任务拆解、工具调用、知识检索、流程编排与结果合成。
这对双方而言,是一场双赢:扣子可借豆包的海量用户快速突破冷启动瓶颈,弥补此前用户规模与数据密度不足的短板;豆包则能在办公心智建设上获得坚实的技术支点,加速完成从“聊天玩具”到“办公搭档”的身份跃迁。
当前最大变数在于——豆包与扣子,同属字节跳动旗下,却是两个独立运作的团队。二者能否真正打破组织壁垒,高效协同,把这套“豆包前端+扣子后端”的架构扎实落地,将成为决定豆包专业版成败的关键一役。
本文来自微信公众号“白鲸实验室”,作者:吴寻,编辑:刘培,36氪经授权发布。











