机器人编程迎来转折点:ASPIRE框架零样本成功率暴涨77%

机器人编程领域正经历一次范式转移。NVIDIA联合密歇根大学、UIUC、UC Berkeley等学术机构共同提出的ASPIRE(自适应自改进编程与经验回收框架),将机器人控制程序的编写从一次性试错转变为持续学习过程。这一框架在多项基准测试中展现了令人瞩目的成果:LIBERO-Pro长任务零样本成功率从4%直接跃升至31%,最强基线表现也仅逼近4%的瓶颈。

ASPIRE的核心创新在于其协调器-执行器双层架构。框架内部构建了一个闭环执行引擎,搭配不断累积的技能库与进化搜索算法。编程智能体基于Claude Code(Claude Opus 4.6,具备百万级token上下文窗口)进行代码生成与优化,这使得机器人能够通过失败调试经验自动沉淀为可复用的技能模块。在Robosuite双手交接测试中,ASPIRE将成功率从20%拉升至92%;BEHAVIOR-1K收音机拾取任务也从56%提升至88%。最大的突破在LIBERO-Pro上,ASPIRE比此前最强基线高出77个百分点,这一差距几乎意味着已有方法的全面超越。

对比当前主流的机器人编程方式,大部分依赖人类专家手动调试或基于强化学习的海量样本训练。前者耗时且不可扩展,后者则在长任务序列中面临稀疏奖励和维度爆炸问题。ASPIRE的路径更具工程启发性:它不追求一次性编程完美,而是构建了一个自我修复经验迁移的系统。技能库允许机器人在不同任务间复用控制程序片段,进化搜索则持续优化代码质量。

特别值得关注的是,ASPIRE在零样本场景下的表现。利用LIBERO-90积累的技能,ASPIRE对LIBERO-Pro Long任务实现了约31%的成功率,而此前方法饱和在4%附近。这印证了技能库的可迁移性与进化搜索的有效性——机器人不再需要从头学习每个新任务,而是可以调用已掌握的控制逻辑进行推理。

从行业趋势看,ASPIRE代表了机器人控制软件发展的关键方向:自主化编程持续学习的融合。这不仅降低了机器人部署的边际成本,也为通用机器人奠定了技术基础。对从业者而言,构建高质量的技能库与调试反馈机制将成为核心竞争力。此外,这一框架对AI大模型(如Claude系列)的深度依赖,也预示着大语言模型在机器人领域的应用将从对话生成转向更为复杂的环境感知与代码优化。

未来,机器人编程将从“写一次、用一次”转变为“写一次、自学无限次”。ASPIRE的思路启发了更广泛的思考:如何让智能体从自身的错误中系统性地受益,而非仅仅依赖更好的初始编程。对于追求实用性的机器人行业,这或许是比单纯提升数值更为深刻的突破。