蚂蚁灵波开源LingBot-Depth模型 让机器人精准抓取透明反光物

lvshuiyouyou2026-01-27 14:02:02TechWeb.com.cn

1月27日消息,蚂蚁集团旗下具身智能公司灵波科技宣布开源高精度空间感知模型 LingBot-Depth。

该模型基于奥比中光Gemini 330系列双目3D相机提供的芯片级原始数据,专注于提升环境深度感知与三维空间理解能力,旨在为机器人、自动驾驶汽车等智能终端赋予更精准、更可靠的三维视觉。

据介绍,在NYUv2、ETH3D等权威基准评测中,LingBot-Depth展现出代际级优势:相比业界主流的 PromptDA与PriorDA,其在室内场景的相对误差(REL)降低超过70%,在挑战性的稀疏SfM 任务中RMSE误差降低约47% 。

在家庭和工业环境中,玻璃器皿、镜面、不锈钢设备等透明和反光物体物体十分常见,但却是机器空间感知的难点。传统深度相机受制于光学物理特性,在面对透明或高反光材质时,往往无法接收有效回波,导致深度图出现数据丢失或产生噪声。

针对这一行业共性难题,蚂蚁灵波科技研发了“掩码深度建模”(Masked Depth Modeling,MDM)技术,并依托奥比中光 Gemini 330 系列双目 3D 相机进行 RGB-Depth 数据采集与效果验证。当深度数据出现缺失或异常时,LingBot-Depth 模型能够融合彩色图像(RGB)中的纹理、轮廓及环境上下文信息,对缺失区域进行推断与补全,输出完整、致密、边缘更清晰的三维深度图。

值得一提的是,LingBot-Depth 模型已通过奥比中光深度视觉实验室的专业认证。实验中,奥比中光 Gemini 330 系列在应用LingBot-Depth 后,面对透明玻璃、高反光镜面、强逆光及复杂曲面等极具挑战的光学场景时,输出的深度图依然平滑、完整,且物体的轮廓边缘非常锐利,其效果显著优于业内领先的3D 视觉公司 Stereolabs 推出的 ZED Stereo Depth 深度相机。

LingBot-Depth 的优异性来源于海量真实场景数据。灵波科技采集约 1000 万份原始样本,提炼出 200 万组高价值深度配对数据用于训练,支撑模型在极端环境下的泛化能力。这一核心数据资产(包括 2M 真实世界深度数据和 1M 仿真数据)将于近期开源,推动社区更快攻克复杂场景空间感知难题。

据了解,蚂蚁灵波科技已与奥比中光达成战略合作意向。奥比中光计划基于 LingBot-Depth 的能力推出新一代深度相机。本周蚂蚁灵波将陆续开源多款具身智能方向模型。

AI催生更多API安全问题,WAAP成防护趋势

4月8日消息,当前,AIGC(生成式人工智能)在各行业各领域得到了广泛应用,API作为AIGC服务商对外输出AI能力的管道,随之而来的API安全问题已日益凸显。API接口的开放性和易用性使其备受开发者青睐,开发、测试和部...

电动汽车有多耗电:比尔盖茨称AI用电量跟它比小得多

9月9日消息,之前外界猛批AI,认为围绕它搭建的设施太耗电,不过比尔盖茨却不这么认为。微软和其他科技公司致力于寻找清洁能源,并成为这些新技术的先驱者,包括地热、核裂变、核聚变等前沿技术。对此,比尔盖茨表示...

字节跳动最新思考模型技术细节公开,将于4月17日开放接口供用户体验

新浪科技讯4月14日中午消息,字节跳动最新思考模型Seed-Thinking-v1.5技术细节公开,将于4月17日通过火山引擎开放接口供用户体验。据介绍,该模型在数学、编程、科学推理等专业领域及创意写作等通用任务中表现突出,...

Kimi逆袭,硅谷纸贵

10月的最后一个工作日,雪豹财经社拜访了月之暗面的北京办公室。我们注意到,月之暗面的会议室都以乐队命名:PinkFloyd、TheRollingStone、Queen、TheBeatles、Radiohead......阿里有“光明顶”,百度有“昆仑”,它...

DeepSeek阴影下的大厂

最后一个反击DeepSeek的主要玩家终于姗姗来迟。2月18日晚间,马斯克的xAI带着Grok3亮相直播。发布会上,马斯克强调,为了训练Grok3,用了超过20万张H100,总训练小时数达到两亿小时。而收获的成果是,在分数上,Grok...

上一篇:微软发布新定制AI芯片Maia 200:台积电3nm工艺,性能强三成还更省水
下一篇:QuestMobile最新报告:文心助手登顶 AI 赛道用户规模榜第一