8月27日,小鹏集团举办了主题为“time 时间”的物理ai技术分享暨第二代vla大模型全新版本体验日活动。作为发布以来的首次重大迭代,小鹏第二代vla迎来关键升级,其最新xos6.3.0系统将率先搭载于小鹏g9l,并实现全球首发。本次升级的核心突破在于赋予ai对“时间”的本质理解能力,推动物理ai基座模型完成从静态三维空间感知向动态四维时空认知的根本性跃迁。
在自动驾驶领域长期践行Scaling Law的小鹏,此次将端侧大模型参数量提升至原有规模的3.5倍,显著拉开了与行业主流轻量化模型之间的数量级差距。依托超长时序上下文记忆能力,AI驾驶员真正实现了“看得清、想得透、反应快”。与此同时,新版本正式引入整车级智能中枢——Master Agent,打通VLA(视觉-语言-动作)与VLM(视觉-语言模型)能力边界,实现智驾与座舱系统的深度协同,并首次将部分Robotaxi级别的L4体验规模化落地至量产车型。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

真实世界并非由孤立帧构成,而是一个连续演进的动态过程;若要让AI具备类人式的环境理解力,首要前提便是建立对“时间流”的建模能力。传统模型虽可识别车辆、行人等静态目标,却难以判断其运动趋势与潜在交互逻辑——它需要知道“刚才发生了什么”、“此刻正在发生什么”,以及“接下来可能发生什么”。为此,第二代VLA创新集成Infini-VLA长时序架构,支持长达30秒的历史世界记忆,使决策具备更广域的时间视野,避免将连贯的道路事件机械切分为割裂画面。
为实时适配瞬息万变的真实路况,第二代VLA同步优化推理架构,采用Streaming Inference(流式自回归推理)技术,推动模型从离散式推断迈向连续化响应,端到端处理效率提升达300%。模型由此具备“边感知、边思考、边执行”的并行处理能力,在应对前车急刹、行人折返、邻车强行加塞等突发场景时,展现出堪比资深人类司机的预判精度与响应敏捷度。
此外,小鹏X-Foresight预测世界模型首次实装上车,可对未来6秒内的交通态势进行高置信度推演,精准刻画周边参与者的行为演化路径。新版还引入MoT混合任务架构,依据城区通行、园区通勤、自动泊车等差异化场景,动态调度模型资源,有效降低多任务间的干扰效应。凭借更大参数量、更远期行为预判、更长有效记忆窗口及更快闭环响应速度,整体多维安全性能相较此前提升20倍。
从零搭建飞书机器人。支持 MiniMax/MiMo 等模型、工具调用(搜索/天气/百科/记忆)、Skill 架构。一站式交付可上线运行的飞书群聊 bot。基础版本,后续可自行升级能力
在智能座舱维度,小鹏首次推出Master Agent智能体中枢,以具身机器人研发范式重构车载操作系统,全面融合VLA与VLM能力。该中枢不仅能准确解析自然语言指令与模糊语义表达,还可自主拆解用户意图,协调智驾、底盘、座舱、车身控制等垂直功能模块的Agent协同作业。本次更新亦新增“语音指令靠边停车”与“语音触发就近泊入”两大实用功能,真正打通“一句话下达指令”到“全链路自主执行”的完整闭环,标志着Robotaxi级L4技术正加速向量产车渗透。
作为一家面向全球市场的具身智能企业,小鹏正依托统一AI技术底座,打通汽车与机器人两大物理载体,加速推进物理AI进入规模化复用新阶段。搭载第二代VLA的Robotaxi已成功获得广州市智能网联汽车远程测试资质,可在指定道路开展主驾无安全员测试。在机器人硬件层面,集成3颗图灵AI芯片的小鹏通用人形机器人IRON,端侧算力高达2250TOPS,已实现复杂任务的全流程自主执行。近期,小鹏机器人业务顺利完成超9亿美元首轮股权融资,投后估值突破63亿美元。
为践行科技普惠理念,小鹏通过学习式Token压缩与知识蒸馏训练技术,成功将第二代VLA核心能力迁移部署至更低算力平台。蒸馏优化后的图灵VLA2.0Lite版本将于9月首发搭载于小鹏G9L Max车型。同时,小鹏正全力推进第二代VLA全球化部署进程,目前已在德国完成本地化验收测试,计划于明年上半年率先取得欧洲监管许可,并面向海外用户启动交付。
支撑这一系列技术跃迁的,是小鹏多年深耕构建的完整AI Infra基础设施体系。依托百万级智能车队与十亿级高质量数据资产,小鹏已建成高效运转的数据飞轮,单次模型训练的数据吞吐量达1亿clips,较半年前增长10倍。随着AI Infra持续沉淀与复用,小鹏正将模型进化能力从单一汽车产品拓展至机器人等多种物理本体,不断拓宽物理AI与现实世界深度交互的能力边界。










