7 月 16 日,全球具身智能强化学习开源框架 RLinf 正式发布 v0.3 版本。百度(BIDU)智能云于发布当天完成适配,成为国内首家支持 RLinf v0.3 的云厂商。开发者可基于百度(BIDU)百舸 AI 计算平台,一键体验 RLinf 最新能力,加速前沿开源成果向产业应用落地。此次 RLinf v0.3 首次打通数据管理、监督微调(SFT)、强化学习(RL)、模型评测及真机部署等关键环节,实现从仿真训练到真机在线学习,再到持续迭代优化的完整开发闭环,为机器人持续进化提供更加完善的技术基础。
国内首家完成 RLinf v0.3 适配,最新开源(300109)成果快速进入产业实践
近年来,具身智能快速发展,机器人训练逐渐从单一算法突破转向数据、模型、算力和工程协同优化。RLinf 作为全球具身智能领域重要的开源强化学习框架,持续快速迭代,已成为机器人强化学习开发的重要基础设施。此次发布的 RLinf v0.3 进一步扩展了模型生态与训练能力,不仅新增支持 DreamZero、GR00T、StarVLA、LingBot-VLA 等主流模型,还完善了真机强化学习、仿真强化学习及 Human-in-the-loop 等训练范式,首次实现机器人持续学习全流程闭环。
百度(BIDU)智能云第一时间完成适配,让开发者无需等待框架迁移,即可第一时间体验最新开源(300109)能力,进一步缩短技术创新向产业应用转化周期(883436)。
百度百舸打造具身智能研发全流程底座,加速模型训练与部署
依托百度(BIDU)百舸 AI 计算平台,开发者可通过 " 快速开始 " 能力,一键启动 RLinf v0.3 开发环境,快速完成 LIBERO 仿真环境、OpenVLA 模型训练等预置镜像部署,无需繁琐配置,即可开展模型开发与训练。
除了快速完成框架适配,百度(BIDU)百舸还依托高性能计算、极致存储及高速互联网络,构建覆盖数据准备、开发训练、仿真验证到推理部署的完整研发链路,并结合 AI Infra 工程优化能力,进一步提升模型训练效率、缩短迭代周期(883436),提高算力资源利用效率,为具身智能研发提供稳定高效的基础设施支撑。
AI Infra 工程优化能力持续验证
此前,百度(BIDU)百舸联合上海交通大学、地瓜机器人共同发布强化学习训练框架 dVLA-RL,首次打通经典 PPO 算法与离散扩散 VLA 模型的适配路径,为机器人 Foundation Model 持续自主进化提供新的技术路径,相关实验全部基于百度(BIDU)百舸 AI 计算平台完成。
目前,百度(BIDU)百舸已服务超过 30 家具身智能头部企业及创新中心。未来,百度(BIDU)智能云将持续携手开源社区、科研机构及产业伙伴,不断完善 AI 计算平台与 AI Infra 工程能力,加速前沿技术创新向产业应用转化,推动具身智能迈向规模化发展。
