AXIS: A Growable Community-Driven Data Engine for Scalable Robot Manipulation
本文介绍了 AXIS,这是一个可扩展的、社区驱动的数据引擎和基准测试,它利用基于浏览器的远程操作和自动化数据处理技术来生成一个包含多样化机器人操控任务的大规模数据集,并证明了在该数据上进行持续预训练与现有模型相比,能显著提升策略性能和扩展行为。
原始论文采用 CC BY 4.0 许可(http://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明
想象一下,你正在试图教一个机器人做家务,比如捡起玩具并把它放进盒子里。为了学习,机器人首先需要观看成千上上个由人类完成这项工作的例子。这被称为“模仿学习”。在过去,获取这些例子就像是雇佣一支微型专家军队站在真实的机器人旁边,用特殊的控制器引导它的手臂。这既昂贵又缓慢,而且仅限于极少数特定的任务。但如果ed你可以把整个互联网变成一个教室呢?如果你可以让任何拥有浏览器的人都来帮助教导机器人,然后使用一台超级聪明的计算机,将人类那些杂乱无章的尝试转化为完美、精炼的课程呢?这就是这篇新论文背后的核心问题:我们如何构建一个永不停歇地成长、随着帮助的增加而变得更好,并且不需要上百万美元硬件投入就能启动的机器人学习系统?
这篇论文介绍了一个名为 AXIS 的“可增长的社区驱动型数据引擎”,旨在解决正是这样的问题。把 AXIS 想象成一个大型的、互动式的视频游戏,数以百万计的人可以登录他们的电脑,玩一个简单的游戏:“拿起蓝色方块并把它放在红色托盘上。”但不仅仅是为了好玩,玩家的每一个动作都会被记录下来并发送到机器人的大脑中。关键在于,玩家并不是在控制一个真实的机器人;他们是在通过网页浏览器控制一个虚拟机器人。这使得任何人都能随时随地轻松参与,而无需特殊的设备。
一旦数据进入,AXIS 就会扮演一个超高效编辑的角色。人类玩家擅长展示“做什么”,但他们的表现往往是杂乱的。他们可能会停顿太久、抖动控制器,或者没能击中目标。AXIS 会自动清理这些记录。它会移除“犹豫”(停顿),平滑掉抖动的线条,并检查任务是否真正成功。然后,它会发挥创造力。它将一个好的示例转化为数千个变体:改变光照、移动家具、让地板变得湿滑,甚至改变物体的纹理。这就像是拿出一份蛋糕食谱,然后瞬间生成成千上上种版本,带有不同的糖粒、口味和烘焙时间,从而让机器人无论在什么样的厨房里都能学会烤蛋糕。
论文发现这种方法效果极其出色。通过在一个庞大的、经过清理且多样化的数据集上训练机器人策略,机器人处理新情况的能力变得更强了。当研究人员测试他们的系统时,他们发现,与标准基准相比,使用完整的 AXIS 数据集(包含超过 50,000 条轨迹和 207 种不同的任务)训练的机器人,其成功率提高了 5.8%。更令人印象深刻的是,它比使用另一个大型数据集训练的类似系统表现高出了 37.3%。这表明,AXXIS 数据的质量和多样性——即来自真实人类并经过计算机大量增强的数据——比仅仅拥有海量的原始数据要更有价值。
结果还显示,机器人看到的数据越多,它就变得越好。当团队测试仅使用 25%、50% 和 100% AXIS 数据的机器人时,成功率从 84.7% 稳步攀升至 85.7%,最后达到 88.8%。机器人变得尤其擅长处理“棘手”的情况,比如相机角度变化、光照异常或物体出现在意想不到的地方。这证明了 AXIS 的“可增长”特性——即数据集可以随着更多人的加入而不断扩展——创造了一个鲁棒且准备好应对现实世界的机器人。
简而言之,AXIS 不仅仅是一个数据集;它是一个活生生的引擎。它将成千上万互联网用户那些混乱、多样且有时杂乱无章的行为,转化为机器人结构化、高质量的课程。它表明,机器人学习的未来不在于实验室里的少数专家,而在于一个全球性的社区共同协作,并由计算机承担重任,将这些集体努力转化为超级智能的机器人技能。虽然论文指出,从模拟环境过渡到真实的物理机器人仍然是一个挑战,但它们在虚拟世界中的结果展示了一条清晰的路径:我们教得越多,机器人的学习效果就越好。
您所在领域的论文太多了?
获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。