【wwww.milan.com科技消息】7月7日,蚂蚁集团旗下具身智能公司灵波科技正式发布空间感知模型LingBot-Depth 2.0,并同步推出视觉基座模型LingBot-Vision,两款模型协同运作,将进一步提升机器人在真实物理世界中的空间感知能力。
蚂蚁集团
LingBot-Depth 2.0基于1.5亿规模数据训练,较上一代300万数据集实现了显著提升。该模型在边缘清晰度、细小物体识别、远距离深度估计及复杂场景鲁棒性等维度全面升级。在深度补全基准16项测评中获得12项第一,其中室内大面积深度缺失场景的深度误差较上代降低约50%。在玻璃、镜面、透明物体等传统深度相机容易失效的场景中,LingBot-Depth 2.0表现尤为突出,能够补全出完整、平整的三维结构图。
与此同时,灵波发布了视觉基础模型LingBot-Vision,这是业内首个将"边界结构"作为预训练目标的视觉模型,可实现亚像素级边界定位与空间结构理解。本次开源ViT-G/L/B/S四个版本模型权重及完整技术报告,供开发者社区免费使用与二次开发。
商业化落地方面,蚂蚁灵波宣布与奥比中光进一步深化合作。双方将围绕数据采集、SDK集成及一体化3D相机等方向推进产品落地,计划推出集成LingBot-Depth能力的SDK和商业版一体化相机设备,为机器人提供更高精度的空间感知能力,加速具身智能产业的规模化应用。
版权所有,未经许可不得转载
ac米兰官网