News
首页  -  资讯  - 
蚂蚁上线运营 LingBot-Depth 2.0,并开源 LingBot-Vision
在 2026 年 1 月开放源代码 LingBot-Depth 1.0 后,蚂蚁集团旗下具身智能公司灵波科技宣布推出全新一代空间感知模型 LingBot-Depth 2.0,以及同步开源视觉基座模型 LingBot-Vision。 根据介绍,LingBot-Depth 是一种面向真实场景的深度补全模型,相当于机器人在物理世界的眼睛。LingBot-Depth 2.0 的训练资料从 1.0 版本的 ...

在 2026 年 1 月开放源代码 LingBot-Depth 1.0 后,蚂蚁集团旗下具身智能公司灵波科技宣布推出全新一代空间感知模型 LingBot-Depth 2.0,以及同步开源视觉基座模型 LingBot-Vision。

根据介绍,LingBot-Depth 是一种面向真实场景的深度补全模型,相当于机器人在物理世界的眼睛。LingBot-Depth 2.0 的训练资料从 1.0 版本的 300 万扩充至 1.5 亿规模,在深度补全基准的 16 项测评中,获得 12 项第一;面对最难的室内大面积深度缺失场景,深度误差较上一代减半(RMSE 从 0.132 降至 0.062);在玻璃、镜面、透明物体等传统深度相机最容易失灵的场景中表现尤为突出,能够补全出完整、平整的三维结构。

配图

LingBot-Vision 此次共开源了 4 个版本—— ViT-G/L/B/S。LingBot-Vision 除了适配 LingBot-Depth 2.0 的训练,还具备"一模多用"的通用能力。

蚂蚁灵波方面表示,LingBot-Vision 是业内首个把"边界结构"作为预训练目标的视觉基础模型,实现了空间感知训练范式的实现跨越。它拥有亚像素级的边界定位与空间结构理解能力,实现了更高精度、更稳定的空间感知能力。

LingBot-Vision 的预训练语料仅为 1.6 亿张图像,比 DINOv3 小一个数量级。即便如此,与主流视觉基础模型相比,LingBot-Vision 对物体边界和空间结构的识别更清晰、更稳定,且能在视频中连续追踪物体边界。

配图