机器人运控训练步入分钟级时代!清华AIR开源UniLab:3分钟训好人形,速度暴涨10倍,Mac上也能跑
本文最后更新于91 天前,其中的信息可能已经过时,如有错误请发送邮件到big_fw@foxmail.com
机器人运控训练步入分钟级时代!清华AIR开源UniLab:3分钟训好人形,速度暴涨10倍,Mac上也能跑
机器人运控训练步入分钟级时代!清华AIR开源UniLab:3分钟训好人形,速度暴涨10倍,Mac上也能跑
机器人运控训练步入分钟级时代!清华AIR开源UniLab:3分钟训好人形,速度暴涨10倍,Mac上也能跑
机器人运控训练步入分钟级时代!清华AIR开源UniLab:3分钟训好人形,速度暴涨10倍,Mac上也能跑

清华AIR DISCOVER Lab投稿

在具身智能训练中,“把计算全部塞进GPU”似乎成了唯一的提速密码,机器人运控并行训练的框架,IsaacLab、MuJoCoPlayground、mjlab都默认遵循这一范式,这些系统都牢牢绑定在NVIDIA生态中。

清华大学智能产业研究院(AIR)DISCOVER Lab联合清华、上交、上海创智学院等多所高校和谋先飞技术、求之科技、原力灵机,正式推出了全新的机器人强化学习训练架构——UniLab。

团队另辟蹊径,通过大胆重构系统结构,打破了“GPU包揽全部”的潜规则,为具身智能打造了全新一代“CPU高效仿真+GPU策略训练”的异构高吞吐训练底座,在多项运控任务训练上实现了数倍效率提升。

UniLab从底层重新组织了仿真、数据采集与策略学习之间的系统结构。

传统GPU管线将物理步进与策略学习同步串行执行,所有的计算都放在GPU上,导致显卡和多核CPU出现“一方计算、一方闲置”的资源闲置。

传统GPU管线将仿真和学习绑在同一块显卡上,资源互相争抢。

UniLab用实测数据证明,将仿真解耦到CPU侧并通过运行时协调,可以带来显著的端到端墙钟时间(Wall-clock Time)收益:

UniLab彻底去除了对特定硬件的硬编码依赖,让机器人强化学习训练走向大众化:

UniLab现已正式开源。

未来项目将围绕接触密集型灵巧操作的物理保真度评测、算法benchmark、以及多模态触觉策略等方向持续迭代,将UniLab从一个高效训练系统进一步扩展为通用的机器人学习研究平台。

项目主页:https://unilabsim.github.io论文链接:https://arxiv.org/abs/2605.30313代码仓库:https://github.com/unilabsim/UniLab

版权声明:

本博客部分内容为转载文章,旨在分享有价值的信息,版权归原作者所有。

转载仅为个人学习与交流目的,不对文章观点负责,亦不用于任何商业用途。

如涉及版权问题,请联系本人删除。

文末附加内容
上一篇
下一篇