具身智能

面向具身智能体在复杂三维环境中的自主感知、认知与行动需求,重点开展物体目标导航、多物体目标导航和视觉语言导航等研究。围绕目标理解、环境探索、场景记忆、空间关系建模、自然语言指令理解与路径规划等关键问题,探索视觉、语言与空间信息的协同建模方法,提升智能体在未知环境、复杂任务和跨场景条件下的自主导航与泛化能力。