当机器人编程仍停留在“一次编写、反复微调”的粗放阶段时,NVIDIA与密歇根大学、UIUC、UC Berkeley等机构联合提出的ASPIRE框架,正在改写这一规则。它通过构建一个持续学习的机器人框架,让程序编写与优化从被动调试转变为主动进化。
ASPIRE的核心在于其协调器-执行器架构。协调器负责任务分解与技能调度,执行器则负责具体控制程序的运行。两者之间通过闭环执行引擎实现实时反馈循环:一旦执行过程中出现失败,系统自动记录故障点,并触发进化搜索机制,在技能库中检索最优补丁方案。这个技能库不是静态的代码仓库,而是动态积累的“失败调试沉淀池”——每一次失败的执行结果被结构化存储,成为后续任务可复用的模块。
在编程智能体的选型上,ASPIRE采用了Claude Code(基于Claude Opus 4.6,支持100万token上下文窗口)。这一选择并非偶然:长上下文窗口允许智能体在单次对话中读入整个技能库的索引,从而在零样本条件下快速调用历史经验,而非每次都从头生成代码。
量化结果印证了这套设计的有效性。在LIBERO-Pro基准测试中,ASPIRE相比最强基线最高提升77个百分点;Robosuite双手交接任务成功率从20%跃升至92%;BEHAVIOR-1K的收音机拾取任务从56%提升至88%。更值得关注的是其零样本泛化能力:利用LIBERO-90积累的技能库,ASPIRE在LIBERO-Pro Long长任务上达到约31%成功率,而此前行业最佳方法仅能维持在4%附近饱和。
这一跃迁揭示了机器人编程领域的关键趋势:零样本泛化的瓶颈不在于算法架构,而在于“失败经验的规模化复用”。过去,研究人员倾向于为每个新任务设计专属的奖励函数或预训练模型,但ASPRIE证明,在有限的低维控制子空间中,通过结构化记录和执行失败的原因,可以将少量成功样例的推理能力扩展到全新任务场景。
工业界应当关注这项技术的落地路径。对于部署在产线的机器人系统而言,ASPIRE意味着从“死记硬背”的示教编程向“举一反三”的进化式学习迁移的成本大幅降低。一个可行的建议是:在现有工业机器人控制框架中嵌入轻量级技能库模块,并与云端Claude Code模型联动,以异步方式完成技能库的增量更新。这将显著降低人工编程介入频次,尤其适合于多品种小批量生产的柔性制造场景。
需要指出的是,ASPIRE在短任务上表现亮眼,但其长任务成功率仍不足三分之一,意味着在复杂序列操作中,协调器的任务分解能力与执行器的闭环鲁棒性仍有提升空间。不过,从4%到31%的跨越,已经为机器人持续学习指明了方向——不是一次性解决问题的“万能模型”,而是能够积累失败经验的“进化系统”,才是通往通用机器人智能的更务实路径。