VoxPoser
VoxPoser是一个3D机器人操作轨迹合成系统,结合大型语言模型和视觉语言模型实现零样本任务执行。该项目在RLBench环境中实现,无需训练数据即可生成复杂操作轨迹。系统通过语言模型程序(LMPs)递归生成代码,分解指令并为子任务组合价值图。VoxPoser包含接口、规划器和控制器等核心组件,用于规划和执行机器人操作任务。