RLinf

面向具身智能与智能体的开源强化学习训练基础设施

RLinf 是由无问芯穹联合清华大学等共同研发的全球首个面向具身智能持续进化的大规模强化学习基础设施项目。它提供从数据采集、数据管理、监督微调(SFT)、强化学习(RL)、模型评测到真机部署的一站式开发平台,支持多种具身模型(VLA模型、世界模型)、仿真器(Genesis、Polaris、RoboVerse、IsaacLab)、真机平台(Franka、GimArm、DOS-W1)以及异构计算硬件(昇腾、AMD ROCm、Musa),实现从仿真训练到真实机器人在线学习的统一开发闭环

世界模型具身导航强化学习训练智能体
访问官网
收录动态

1

最近更新

2026-07-16

评价样本

未收录

GitHub Stars

4,197

工具功能

这个工具能做什么、适合谁用,以及目前已识别的核心能力。

工具简介

RLinf 是由无问芯穹联合清华大学等共同研发的全球首个面向具身智能持续进化的大规模强化学习基础设施项目。它提供从数据采集、数据管理、监督微调(SFT)、强化学习(RL)、模型评测到真机部署的一站式开发平台,支持多种具身模型(VLA模型、世界模型)、仿真器(Genesis、Polaris、RoboVerse、IsaacLab)、真机平台(Franka、GimArm、DOS-W1)以及异构计算硬件(昇腾、AMD ROCm、Musa),实现从仿真训练到真实机器人在线学习的统一开发闭环

核心功能

4 项已整理
世界模型
具身导航
强化学习训练
智能体

价格信息

暂无可验证价格信息

暂无足够准确的价格信息。

基础信息

更新频率
近 7 天 1 条收录动态
最近更新
2026-07-16
覆盖行业
科研、制造业

更新日志

按时间记录功能更新、版本发布、新工具入库等重要变化。

  1. 2026-07-16版本发布

    RLinf v0.3发布:首次打通数据采集->SFT->RL->真机部署全闭环,新增6款具身模型(Dexbotic DM0、DreamZero、GR00T-N1.6/N1.7、ABot-M0、StarVLA、LingBot-VLA),新增5种仿真器(Genesis/Polaris/RoboVerse等),新增3种遥操作方式与3款真机平台支持,新增AgentLightning智能体RL训练,全面支持昇腾/AMD ROCm/Musa异构计算平台。

RLinf 常见问题

关于 RLinf 的定位、核心功能、价格与最近更新。

RLinf 是什么?

RLinf 是由无问芯穹联合清华大学等共同研发的全球首个面向具身智能持续进化的大规模强化学习基础设施项目。它提供从数据采集、数据管理、监督微调(SFT)、强化学习(RL)、模型评测到真机部署的一站式开发平台,支持多种具身模型(VLA模型、世界模型)、仿真器(Genesis、Polaris、RoboVerse、IsaacLab)、真机平台(Franka、GimArm、DOS-W1)以及异构计算硬件(昇腾、AMD ROCm、Musa),实现从仿真训练到真实机器人在线学习的统一开发闭环。

RLinf 有哪些核心功能?

RLinf 当前已核验的核心功能包括:世界模型、具身导航、强化学习训练、智能体。

RLinf 如何收费?

AI Equal 当前没有收录 RLinf 的可验证价格信息。

RLinf 最近有什么更新?

2026-07-16:RLinf v0.3发布:首次打通数据采集->SFT->RL->真机部署全闭环,新增6款具身模型(Dexbotic DM0、DreamZero、GR00T-N1.6/N1.7、ABot-M0、StarVLA、LingBot-VLA),新增5种仿真器(Genesis/Polaris/RoboVerse等),新增3种遥操作方式与3款真机平台支持,新增AgentLightning智能体RL训练,全面支持昇腾/AMD ROCm/Musa异构计算平台。