7 月 7 日,蚂蚁集团孵化的具身智能企业灵波科技正式推出全新升级的空间感知模型 lingbot-depth 2.0,并同步发布视觉基础模型 lingbot-vision。两大模型协同工作,显著增强机器人在真实物理环境中的三维空间理解与感知能力。

蚂蚁集团
LingBot-Depth 2.0 基于规模达 1.5 亿的数据集进行训练,相较前代仅含 300 万样本的数据集,实现数量级跃升。该模型在边缘细节还原、微小物体识别、远距离深度预测以及复杂多变场景下的稳定性等关键指标上均完成全面优化。在涵盖 16 项任务的深度补全权威基准测试中,斩获 12 项排名第一;尤其在室内大范围深度信息缺失的典型挑战场景下,平均深度误差较上一代降低约 50%。面对玻璃、镜面及各类透明材质等传统深度传感器普遍失效的难题,LingBot-Depth 2.0 展现出卓越性能,可精准重建完整、连续且几何一致的三维空间结构。
此外,灵波科技正式开源视觉基座模型 LingBot-Vision,这也是业界首个以“边界结构建模”为核心预训练目标的大规模视觉模型,支持亚像素级轮廓定位与高精度空间构型解析。本次开放 ViT-G、ViT-L、ViT-B、ViT-S 四个参数量级的模型权重,并同步发布完整技术白皮书,面向全球开发者免费提供下载与定制化开发支持。
在商业化推进层面,灵波科技宣布与奥比中光达成更深层次战略合作。双方将聚焦于高质量三维数据采集体系建设、SDK 软件集成方案开发及一体化 3D 视觉模组产品化等方向,联合打造搭载 LingBot-Depth 技术能力的标准 SDK 工具包与商用级一体式 3D 相机硬件设备,为机器人本体提供更高鲁棒性、更高精度的空间感知底座,助力具身智能加速迈向规模化落地阶段。









