⏶5
GaP:一种图即策略多智能体自学习框架用于变分自动化任务
发表
由
Kaiyuan Eric Chen 提交
作者: Kaiyuan Chen, Shuangyu Xie, Letian Fu, Justin Yu, William Pacini, Sandeep Bajamahal, Hudson Kim, Jaimyn Drake, Daehwa Kim, Haoru Xue, Jonathan Francis, Christian Juette, Peter Schaldenbrand, Muhammet Yunus Seker, Ruwan Wickramarachchi, Uksang Yoo, Guanzhi Wang, Adithyavairavan Murali, Balakumar Sundaralingam, S. Shankar Sastry, Spencer Huang, Yuke Zhu, Linxi "Jim" Fan, Ken Goldberg
摘要
AI 生成总结
Graph-as-Policy 系统将模块化机器人技能与多智能体编码相结合,通过并行仿真细化来提高可变自动化任务的可靠性。为了使机器人在商业和工业应用中可靠工作,智能体编码系统的最新进展能否将可解释的机器人编程与无模型策略的开放世界适应性相结合?我们专注于“变异自动化”(VA),这是一类在物体几何和姿态方面比固定自动化具有更大变化的任务。无模型策略通常难以弥合VA任务的可靠性差距,这些任务必须在商业和工业应用中持续可靠地执行。受先前关于任务与运动规划(TAMP)和机器人操作系统(ROS)工作的启发,我们引入了Graph-as-Policy(GaP),一个多智能体编码线束,它从模块化开放机器人技能库(MORSL)生成带有感知、规划和控制节点的有向计算图。然后,GaP生成一个内部仿真环境,并行排练具有不同图的任务实例,以迭代地改进图结构和参数,从而提高成功率和吞吐量。对8个新的开放VA任务基准(4个在仿真中,4个在真实世界中)的评估表明,GaP可以实现显著优于基线的成功率。详细信息、代码和数据可在https://graph-robots.github.io/gap在线获取。
图即策略(GaP)构建可解释的计算图(如ROS),而非单一的端到端策略,旨在实现变分自动化——在对象形状和姿态各异但工作单元固定的重复性工业任务中(如打包杂货、制作咖啡、分拣包裹)。一个基于编码智能体的多智能体线束分解任务,并从一个包含50多个模块化机器人技能的开放库中组装一个图;该图在模拟中进行演练,利用接触反馈诊断自身故障,并重写自身结构直至性能稳定,然后从模拟转移到真实环境。在物体姿态变化下,无模型VLA策略的成功率降至约20%,而GaP达到了93–99%;在一个双手操作的箱子清洗任务中,它通过自动化微调匹配了手工工程代码。论文、代码、8任务基准套件和完整的技能库均已开源。