让机器人学会“吃一堑长一智”?ASPIRE框架重新定义机器人编程

机器人编程正在经历一场范式转换:从“一次性编程”转向“持续学习”。NVIDIA联合密歇根大学、UIUC、UC Berkeley等提出的ASPIRE框架,正是这一转变的典型代表。

传统机器人编程的困境在于:每次任务失败后,工程师需要手动调试代码,而调试经验往往随项目结束而流失。ASPIRE通过协调器-执行器架构、闭环执行引擎、技能库和进化搜索,实现了一个自我优化的编程闭环。其核心编程智能体采用Claude Code(Claude Opus 4.6,1M token上下文窗口),能够处理长达数万行的复杂程序。

在LIBERO-Pro基准测试中,ASPIRE相比最强基线最高提升77个百分点;Robosuite双手交接任务从20%提升至92%;BEHAVIOR-1K收音机拾取任务从56%提升至88%。更值得关注的是零样本场景:利用LIBERO-90积累的技能,ASPIRE在LIBERO-Pro Long长任务上达到约31%成功率,而此前最优方法仅饱和在4%附近。

这一突破的核心在于技能库机制。ASPIRE将每次失败调试中产出的有效代码片段、参数配置和执行策略,抽象为可复用的模块化技能。当面对新任务时,系统能像人类工程师一样“翻阅”过往经验,而非从零开始。这种机制直接推高了长任务的成功天花板——此前4%的瓶颈正是由于传统方法无法有效利用历史知识。

值得关注的是,ASPIRE采用的进化搜索策略赋予了系统自主优化能力:在任务执行过程中,系统会持续收集错误信息,通过回溯分析定位问题根因,并自动生成备选方案。这种“试错-学习-优化”的闭环,使得机器人的编程成本从每次任务独立调试,转变为一次性框架训练。

从行业视角看,ASPIRE揭示了一个趋势:机器人编程正从“编写代码”转向“训练系统”。未来,机器人软件栈的核心竞争力将不再取决于工程师的调试技巧,而在于系统能否高效地沉淀和复用经验。对于开发者而言,尽早建立结构化的技能库,并采用支持持续学习的框架,将成为应对复杂场景的关键策略。