机器人编程革命:从单次试错到持续学习,ASPIRE让零样本成功率跃升77%

机器人编程长期陷入“一次编写、终身调试”的困局,这背后并非算法不够精巧,而是缺乏将失败经验转化为复用知识的能力。NVIDIA联合密歇根大学、UIUC和UC Berkeley提出的ASPIRE框架,正试图打破这一范式——它不再追求单次任务的完美执行,而是构建一个能自我进化、持续学习的机器人编程系统。

ASPIRE的核心架构包含协调器(Coordinator)和多个执行器(Executor),通过闭环执行引擎与可扩充的技能库(Skill Library),实现机器人控制程序的动态生成与迭代优化。其中,编程智能体使用Claude Code(Claude Opus 4.6,支持100万token上下文窗口),而这一选择极具深意:大模型的长上下文特性,恰好为机器人任务的长时间链推理提供了技术底座。

具体成果上,ASPIRE在三大基准测试中展现出显著优势:在LIBERO-Pro上,相对最强基线成功率提升高达77个百分点;Robosuite双手物品交接任务,成功率从基线的20%大幅提升至92%;BEHAVIOR-1K收音机拾取任务,也从56%跃升至88%。这些数字并非孤立成绩,其背后逻辑更为关键——ASPIRE通过进化搜索(Evolutionary Search)机制,自动将失败的尝试记录、分析、修正,并沉淀为技能库中的新“模块”,供后续任务直接调用。

零样本场景下的突破最能反映这一架构的价值。传统方法在处理长任务时,往往因无法有效复用过去经验而迅速失效。ASPIRE利用从LIBERO-90积累的技能,在LIBERO-Pro Long任务中完成零样本操作,成功率从此前方法饱和的4%左右一举跃升至约31%。这意味着ASPIRE不再需要为每个新任务重新编写全部程序,而是像人类开发者一样,从经验库中检索、组合、适配已有解决方案。

从行业趋势观察,ASPIRE的路径与当前机器人研究的两大方向深度契合:一是大模型作为智能体进行编程控制,二是持续学习与知识迁移。此前多数研究聚焦于单任务上模型能力的提升,却忽略了“失败——记录——复用”这一闭环的价值。ASPIRE某种意义上回答了机器人实践中的根本难题:如何让程序不再是“一次性消耗品”。

若以更长远视角看,ASPIRE所展示的进路或许比具体数字更具启发性。当机器人编程从“一次性工程”转向“持续自进化”时,技能库的碎片化积累能为长尾、复杂任务提供意外突破口。当然,ASPIRE仍处于研究阶段,其技能库跨任务泛化性与系统复杂度之间的权衡,将是后续深入的关键。但对行业而言,这一方向已经清晰:让机器人学会从每一次失败中学习,比让它在单次任务中成功100次,更具颠覆性意义。