光鉴科技发布具身智能视觉感知方案,含AI双目模组
光鉴科技推出AI双目视觉方案,解决机器人在复杂材质下的感知难题,为具身智能规模化落地打下视觉基础。
机器人走进真实世界面临玻璃、反光等复杂场景,传统视觉常失效。光鉴科技用AI增强的双目视觉(结合算法理解物体结构而非仅依赖纹理),让机器人在弱纹理、透明物体前也能稳定输出深度信息,同时降低算力消耗,为VLA等大模型推理留出空间。
正文摘录
.16.32.png) 随着多模态大模型和 VLA 等技术不断发展,具身智能正加速迈向产业化。机器人拥有了越来越强的理解、推理和决策能力,但真正进入家庭、工厂、商业等真实场景后,决定其应用能力的,不只是“大脑”是否足够聪明,更在于能否准确感知和理解物理世界。 自主导航、精细抓取、人机交互等能力,都建立在可靠的三维视觉感知基础之上。视觉感知不只是深度数据的输出,更是机器人理解环境、执行任务的重要基础。如何在复杂场景下持续输出精准、稳定、高效的视觉信息,正成为具身智能迈向规模化应用的重要基础。 基于这一趋势,光鉴科技正式发布具身智能视觉感知方案。该方案以 AI 双目视觉技术为核心,融合智能感知算法与高效计算架构,为机器人提供覆盖环境感知、空间理解、导航定位、精细操作等核心场景的视觉能力,助力具身智能加速走向真实世界。 为什么具身智能需要更强的视觉感知? 随着具身智能不断走向真实世界,机器人视觉正面临新的挑战。 首先,真实环境更加复杂。透明玻璃、高反射金属、弱纹理墙面、黑色物体等复杂场景广泛存在,对深度信息的完整性和稳定性提出了更高要求。传统双目立体匹配方案在这些场景下容易出现深度缺失、点云噪点等问题,影响具身智能对环境的准确理解,进而影响避障、抓取、导航等任务的执行效果。 其次,具身智能承担的任务更加多元。从导航、避障到抓取、操作,再到人机交互,一套视觉系统不仅要输出高质量的深度信息,还需要同时支撑 SLAM 定位、目标检测、VLA 推理等多类任务,实现感知与智能的高效协同。