蚂蚁灵波发布空间原生视觉基模 LingBot-Vision,11 亿参数获 12 项第一
蚂蚁灵波自研空间原生视觉基模,以 11 亿参数在复杂场景深度估计上超越大模型,解决了机器人对透明物体和细小物体的感知难题。
蚂蚁灵波推出 LingBot-Depth 2.0 空间感知模型,底层采用自研的 LingBot-Vision 视觉基础模型(专为具身智能设计,理解物体三维边界而非仅识别类别),仅 11 亿参数就在玻璃、反光、细小物体等困难场景的深度估计上取得 12 项世界第一,并开源模型。
正文摘录
 新智元报道  【新智元导读】 蚂蚁灵波的 LingBot-Depth 2.0 发布了,直接拿下 12 项世界第一。深入了解后发现:他们彻底放弃了 DINOv3,从头自研预训练基座,仅用 11 亿参数就超越了 70 亿参数的大模型,并且宣布重磅开源。 就在今天,蚂蚁灵波交出了一份让整个具身智能(Embodied AI)行业都为之瞩目的成绩单。 玻璃、镜子、透明物体——这些困扰行业已久的重大难题,被他们解决了。  LingBot-Depth 2.0 空间感知模型,在行业公开数据集与私有高精度测试集的评测中,一举拿下了 12 项世界第一。  如果你的机器人曾在实验室里无所不能,却在现实世界中把透明玻璃当空气、被细小电线绊倒,甚至因为反光原地打转……LingBot-Depth 2.0 的出现,将彻底改写这个尴尬的局面。  消息一出,立刻在 X(Twitter)上刷屏。