机器人编程长久陷于“单次尝试,失败重置”的怪圈。每一次新任务都需要从头调试,即便显式命中也无法复用此前经验。NVIDIA联合密歇根大学、UIUC、UC Berkeley等提出的ASPIRE框架,正尝试打破这一困局——它将编程过程从一次性脚本变为持续学习循环,核心在于将每次调试失败转化为可复用的技能库。
ASPIRE的架构设计颇具层次感:协调器-执行器构成决策中枢,协调器解析任务目标并拆解为子步骤,执行器则调用底层控制程序完成操作。闭环执行引擎提供实时反馈,允许系统在动作出错时自动回滚或调整。最关键的是技能库——一个不断膨胀的模块化程序集合,每个技能对应一个已验证的原子操作。系统通过进化搜索算法,在技能库中组合、变异出更复杂的控制流程,而引导这一搜索的编程智能体正是Claude Code(基于Claude Opus 4.6,拥有1M token上下文窗口),它能理解长程任务描述并生成可执行的Python/PyBullet代码。
实验数据揭示了这套机制的非线性突破。在LIBERO-Pro基准上,ASPIRE相比最强基线提升高达77个百分点(从接近零到接近77%);Robosuite双手交接任务成功率从20%提升至92%;BEHAVIOR-1K收音机拾取任务从56%跃升至88%。更值得关注的是零样本长任务场景:利用在LIBERO-90上积累的30个技能,ASPIRE在未见过、需要多步推理的LIBERO-Pro Long任务上达到了约31%成功率——而此前所有方法饱和在4%附近,意味着先前系统几乎无法完成任何跨步骤泛化。
这一提升并非单纯来自更大模型或更复杂代码,而是源于结构化复用。传统方法在遇到新任务时只能从零生成代码,ASPIRE则先搜索技能库,若匹配失败才调用编程智能体从头编写。每产生一个有效技能,后续所有任务都能受益。例如双手交接从20%到92%,关键在于系统通过多次进化搜索学会了“等待-抓取-释放”的时间耦合技能,而非每次重新计算手部轨迹。
ASPIRE的深层意义在于重新定义了机器人编程的效率模型。当下行业普遍关注端到端大模型或仿真到现实的迁移,但往往忽略调试过程的浪费。ASPIRE提供了一条更务实的路径:让失败的调试输出变成资产——每错误一次,技能库就补一个选项。这种思路与软件工程中的“知识库复用”异曲同工,但首次在机器人控制层面实现自动化闭环。
趋势预判上,未来机器人编程将不再是单次“写-跑-改”的线性过程,而是持续进化的系统。技能库的积累会形成特定场景的“机器人方言”,进化搜索则像遗传算法一样自动优化组合。不过挑战依然存在:当前技能库依赖人工定义的任务边界,对于完全开放环境仍需更强的语义理解。但ASPIRE已经证明了,在中等复杂度任务下,持续学习框架能使零样本泛化产生质变,而这正是走向通用机器人控制的关键一步。