NVIDIA联合高校提出的ASPIRE框架:让机器人通过“自学”操作系统

机器人编程正从静态设计走向动态进化。NVIDIA 联合密歇根大学、UIUC、UC Berkeley 等机构提出的 ASPIRE 框架,为这一转变提供了技术路径。该框架通过模拟闭环执行机制,将失败调试沉淀为可复用技能库,打破了传统机器人系统了一次性编程、场景受限的僵局。

ASPIRE 的核心是协调器-执行器双重架构。协调器由 Claude Code(基于 Claude Opus 4.6 模型,具备 1M token 上下文窗口)驱动,负责拆解任务、生成初始控制程序;执行器则实时反馈执行结果,形成闭环迭代。这种结构使得编程智能体不仅能编写代码,还能通过进化搜索自动修正逻辑漏洞,将每次失败转化为技能库中的新模块。这与传统强化学习依赖海量试错的路径形成鲜明对比——ASPIRE 更强调在少量尝试中快速抽象出通用模式。

性能数据印证了这种设计的有效性。在 LIBERO-Pro 基准测试中,ASPIRE 比最强基线方法高出 77 个百分点;Robosuite 中的双手交接任务成功率从 20% 跃升至 92%;BEHAVIOR-1K 收音机拾取任务从 56% 提升至 88%。更值得关注的是零样本泛化能力:基于 LIBERO-90 积累的技能,ASPIRE 在 LIBERO-Pro Long 长序列任务上达到约 31% 成功率,而此前最优方法仅 4%。这 7 倍的提升说明,当技能库覆盖足够多的原子操作时,框架能够像人类举一反三一样组合已有知识应对新场景。

从行业视角看,ASPIRE 的启发不止于技术细节。它首次在机器人控制程序合成中实践了持续学习理念:编程智能体不再是一次性解题者,而是通过反复试错-修正-沉淀积累领域常识。这种范式若能普及,将大幅降低机器人部署到非结构化环境时的调试成本——工业界机器人编程常因场景细微变化而需重写逻辑,ASPIRE 则让系统具备自适应补丁能力。

趋势判断上,类似 ASPIRE 的程序合成 + 技能库路径可能成为大模型落地机器人的主航道。它避开了端到端策略对海量数据的依赖,转而利用大模型对代码和逻辑的理解力,将物理世界的不确定性封装进可维护的模块。未来,开发者或许只需关注任务描述和技能库的标注质量,程序编写与调试将更多由 AI 代理自主完成。