机器人编程正从静态设计走向动态进化。NVIDIA 联合密歇根大学、UIUC、UC Berkeley 等机构提出的 ASPIRE 框架,为这一转变提供了技术路径。该框架通过模拟“闭环执行”机制,将失败调试沉淀为可复用技能库,打破了传统机器人系统“了一次性编程、场景受限”的僵局。
ASPIRE 的核心是“协调器-执行器”双重架构。协调器由 Claude Code(基于 Claude Opus 4.6 模型,具备 1M token 上下文窗口)驱动,负责拆解任务、生成初始控制程序;执行器则实时反馈执行结果,形成闭环迭代。这种结构使得编程智能体不仅能编写代码,还能通过“进化搜索”自动修正逻辑漏洞,将每次失败转化为技能库中的新模块。这与传统强化学习依赖海量试错的路径形成鲜明对比——ASPIRE 更强调在少量尝试中快速抽象出通用模式。
性能数据印证了这种设计的有效性。在 LIBERO-Pro 基准测试中,ASPIRE 比最强基线方法高出 77 个百分点;Robosuite 中的双手交接任务成功率从 20% 跃升至 92%;BEHAVIOR-1K 收音机拾取任务从 56% 提升至 88%。更值得关注的是零样本泛化能力:基于 LIBERO-90 积累的技能,ASPIRE 在 LIBERO-Pro Long 长序列任务上达到约 31% 成功率,而此前最优方法仅 4%。这 7 倍的提升说明,当技能库覆盖足够多的原子操作时,框架能够像人类“举一反三”一样组合已有知识应对新场景。
从行业视角看,ASPIRE 的启发不止于技术细节。它首次在机器人控制程序合成中实践了“持续学习”理念:编程智能体不再是“一次性解题者”,而是通过反复“试错-修正-沉淀”积累领域常识。这种范式若能普及,将大幅降低机器人部署到非结构化环境时的调试成本——工业界机器人编程常因场景细微变化而需重写逻辑,ASPIRE 则让系统具备“自适应补丁”能力。
趋势判断上,类似 ASPIRE 的“程序合成 + 技能库”路径可能成为大模型落地机器人的主航道。它避开了端到端策略对海量数据的依赖,转而利用大模型对代码和逻辑的理解力,将物理世界的不确定性封装进可维护的模块。未来,开发者或许只需关注任务描述和技能库的标注质量,程序编写与调试将更多由 AI 代理自主完成。